蚂蚁集团周俊:万亿参数模型从“追求数量”迈向“深耕密度”

蚂蚁集团副总裁周俊在 AICon 会议上指出,万亿参数大模型运行 15 分钟的算力成本已相当于一辆特斯拉,团队提出从“更多 Token”转向“更高 Token 密度”的策略,并通过混合线性注意力架构和 Kpop 算法,让十亿参数模型在 Agent 任务上超越更大模型,且推理成本降低十倍以上。

蚂蚁集团副总裁周俊在 AICon 会议上指出,万亿参数大模型运行 15 分钟的算力成本已相当于一辆特斯拉,团队提出从“更多 Token”转向“更高 Token 密度”的策略,并通过混合线性注意力架构和 Kpop 算法,让十亿参数模型在 Agent 任务上超越更大模型,且推理成本降低十倍以上。

2026年7月7日,Meta正式发布其超级智能实验室(Super Intelligence Lab)的首个图像生成模型Muse Image,该模型已免费部署在Meta AI应用、Instagram和WhatsApp中,支持对话式生成高质量图像、文字渲染和购物预览等实用功能。
![[Bug]: Router retry_policy set via UI/ POST / Config/update is silently dropped (never persisted or applied)](https://www.chat-gpts.plus/wp-content/uploads/2026/07/31308-001b0085-768x403.jpg)
用户运行 LiteLLM Proxy Server 时,通过 Admin UI 的 Router Settings 页面(Reliability & Retries 区域)设置 retry_policy (例如: {"RateLimitErrorRetries": 3} ),点击保存后 UI 提示成
![[Bug]: Prompt caching broken for Bedrock Application Inference Profiles via /v1/messages endpoint](https://www.chat-gpts.plus/wp-content/uploads/2026/07/26625-4d39e2a9-768x403.jpg)
用户在 LiteLLM 中配置了 Bedrock App Inference Profile(ARN 格式,如 bedrock/converse/arn:aws:bedrock:us-east-1:ACCOUNT:application-inference-profile/PROFILE_ID ),

Anthropic 于 7月8日宣布,其任务型AI助手 Claude Cowork 正式扩展至网页和移动端,支持跨设备无缝续接会话与文件操作。官方数据显示,该产品超过九成使用场景并非编程,而是集中于运营、内容创作等知识型工作,标志着AI助手从“程序员工具”向“通用办公伙伴”的角色转变。

美国AI公司Anthropic于7月7日宣布,将在纽约曼哈顿租赁一整栋16层办公楼,并计划年内将当地员工人数翻倍至1000人。此举标志着这家以Claude系列模型闻名的公司正从“西海岸总部为主”转向“东西海岸双核心”布局,加速在金融与媒体中心抢夺人才与客户。

Claude Cowork 从桌面应用升级为覆盖移动端和网页的全场景协作工具,后台任务支持“常在线”运行,并首次公开了基于 60 万机构和 120 万条对话的使用数据,揭示 AI 办公的真实需求并非编码,而是业务流程自动化。

追觅(Roborock)于 7 月 7 日发布了内置 JoyInside 大模型的 AI 电子宠物 Domi,定价 312 元。这款产品不再只是简单的录音播放玩具,而是能通过语音和触觉进行多模态交互、具备知识问答能力的 AI 伴侣,试图切入儿童陪伴与智能教育市场。

GitHub 宣布,开源权重模型 Kimi K2.7 Code 在面向 Pro 用户后,现已扩展至 Copilot Business 和 Enterprise 订阅计划,成为 Copilot 模型选择器中首个可选的开源权重模型,为企业提供了更低成本的编程辅助选项。

一辆 Waymo 自动驾驶出租车在巡视过程中检测到车内两名青少年饮酒并使用玩具枪射击,随即自动报警并停车等待警方处理。这不仅是自动驾驶汽车安全功能的又一次展示,更暴露了无人驾驶出租车在用户行为监控与隐私保护之间的新难题。