标签: 算力

如何在一张 GPU 上服务 100 个微调模型

如何在一张 GPU 上服务 100 个微调模型

开发者 Avi Chawla 在 2026 年 9 月发布的一篇技术解读指出,借助多 LoRA 服务架构,一张 80GB GPU 可以同时对外服务 100 个微调模型变体;相比给每个变体单独部署端点,共享基础权重能把显存占用从约 1.5TB 压缩到约 19.3GB。

打造 AI,加速科学发展,改善人类生活

打造 AI,加速科学发展,改善人类生活

Google 在 2026 年 9 月 15 日集中披露了一批科学 AI 进展,覆盖基因组预测、天气预报、公共卫生预警和疾病早筛,并宣布其语言技术已支持 300 多种语言、覆盖全球约 86% 人口。这轮发布的关键不在模型本身,而在于这些工具已经进入真实场景运行。

AI助力社会影响

AI助力社会影响

Google 在 2026 年 9 月 15 日集中发布了一组以“AI 助力社会影响”为主题的内容,涵盖科学发现、语言覆盖、经济数据平台以及山火、气旋、洪水三类灾害预测。它值得关注的地方在于,Google 这次讲的不是模型跑分,而是 AI 在真实公共议题上的落地进展。