蚂蚁集团周俊AICon演讲:从Token数量到Token密度,万亿参数模型效率优先

蚂蚁集团副总裁周俊在AICon大会上提出,万亿参数大模型的算力成本已达到“每运行15分钟消耗一辆特斯拉”的惊人水平,行业必须从追求Token数量转向提升Token密度,即用更少Token完成同等智力任务。核心解法是协同改造模型架构、训练策略和智能体能力,而非单点优化。

蚂蚁集团副总裁周俊在AICon大会上提出,万亿参数大模型的算力成本已达到“每运行15分钟消耗一辆特斯拉”的惊人水平,行业必须从追求Token数量转向提升Token密度,即用更少Token完成同等智力任务。核心解法是协同改造模型架构、训练策略和智能体能力,而非单点优化。

Claude 开发者官方团队披露了两种高效多智能体架构模式——Advisor(顾问)和 Orchestrator(编排者),通过让高性能模型 Fable 5 与低成本模型 Sonnet 5 混合协作,能在保留顶级模型近 92%-96% 性能的同时,将成本压缩至 46%-63%。这为 AI 应用的工程化落地提供…

Feyn Labs 于 2025 年 6 月 25 日发布 Pulpie 模型系列,以 1/20 的成本实现了与现有最佳网页内容提取器相当的精度,其最小模型在参数量仅为对手 1/3 的情况下,处理速度提升 20 倍,每处理 10 亿页的成本从 15.9 万美元降至 7,900 美元。这意味着大规模高质量网页数…

SpaceX已正式向美国联邦通信委员会(FCC)提交申请,计划发射并运营一个由10万颗卫星组成的第三代星链星座,目标不仅是覆盖偏远地区的互联网,更是要为AI时代打造全球通信基础设施。

前 OpenAI 研究员田永龙被曝已加入腾讯,将主导混元大模型的多模态视觉语言模型(VLM)研发。这是继姚顺雨之后,又一位具备 OpenAI 核心研发背景的人才加入腾讯,反映出腾讯在大模型领域正在持续加大投入,特别是在多模态和视觉理解方向。

微软正在将旗下Excel和Outlook中的部分AI任务从OpenAI和Anthropic的模型切换至自研MAI模型,以降低高昂的第三方模型调用成本。这一调整表明微软在自研大模型上取得阶段性突破,并开始逐步构建更独立的AI技术矩阵。

SpaceXAI 与代码编辑器 Cursor 正在进行深度技术合作,基于 SpaceXAI 的大规模算力中心从头训练一个全新 AI 模型,传闻其关键性能有望达到 OpenAI GPT-5.5 或 Anthropic Claude Opus 4.8 的水平,模型最快可能于今日(2026年7月8日)正式发布。

开源桌面 AI 助手 Rowboat 于近期发布,通过将全部数据存储在本地 Markdown 文件并支持本地模型运行,主打“长期上下文记忆”与深度工作流集成。它试图解决当前 AI 工具普遍存在的隐私顾虑与冷启动问题,为开发者和知识工作者提供一种数据自主权更高的新选择。

微软正在将自研的MAI系列模型部署到Excel、Outlook等核心Office产品中,取代此前依赖的OpenAI和Anthropic模型。此举在降低成本的同时,也标志着微软在AI模型上的独立性取得实质性突破。

蚂蚁集团副总裁周俊在 AICon 会议上指出,万亿参数大模型运行 15 分钟的算力成本已相当于一辆特斯拉,团队提出从“更多 Token”转向“更高 Token 密度”的策略,并通过混合线性注意力架构和 Kpop 算法,让十亿参数模型在 Agent 任务上超越更大模型,且推理成本降低十倍以上。