智源大会最清醒的一句话:大模型的下一场仗,不在屏幕里打了

智源大会第二天,多位专家明确表示,当前大模型的能力主要停留在文本和视频生成的“屏幕世界”里,真正的AI竞争正在转向让机器理解并操作真实物理世界——即世界模型与具身智能的结合。这场转变意味着技术路线、数据需求和评价标准都将发生根本性变化。

智源大会第二天,多位专家明确表示,当前大模型的能力主要停留在文本和视频生成的“屏幕世界”里,真正的AI竞争正在转向让机器理解并操作真实物理世界——即世界模型与具身智能的结合。这场转变意味着技术路线、数据需求和评价标准都将发生根本性变化。

一位开发者发现,在与大语言模型交流时,模型常常固守单一立场或模式,即便对话方向已偏离初始意图,而常规的重置对话或清空上下文效果有限。这一问题在开发者社区引发了对LLM“认知僵化”的讨论,揭示出当前模型在长程推理与动态适应上的结构性短板。

普华永道最新报告指出,AI 在医疗领域的早期应用不仅没有降低成本,反而通过优化编码和诊断记录,推高了医疗账单。这一发现挑战了“AI 必然降本增效”的普遍预期,揭示了技术落地过程中的利益错位。

开发者通过对比实验发现,在 Copilot CLI 中使用命令行包装的 MCP(模型上下文协议)工具,比直接加载完整 MCP schema 的代理模式节省约 5k 令牌的初始上下文开销,但实际执行效率和稳定性各有优劣。这项实验揭示了当前 AI 编码代理在“工具发现”阶段的成本分布差异。

《卫报》专栏文章报道,一批“妈妈网红”正在推广用 ChatGPT 等 AI 工具分担育儿规划,甚至将 AI 包装为“比人类伴侣更好的共同育儿者”,反映出婚姻中家庭劳动分配不公的长期问题正被技术商业化所利用。
![[推广] # 自己搭的 AI 中转站,给 V 友送点福利$15,稳定用了半年了](https://www.chat-gpts.plus/wp-content/uploads/2026/06/ai_cover_5-503-768x403.jpg)
一个自用型 AI API 中转站在 V2EX 社区主动推广,声称稳定运行超过半年,并向新用户提供合计 15 美元的免费额度,试图通过社区口碑和推荐返利机制获取开发者用户。

智谱 AI 于 2026 年 6 月 13 日发布新一代旗舰模型 GLM-5.2,主打可实用的 100 万 token(1M)上下文窗口和强大的编程能力,并承诺最快下周以 MIT 许可证开源,同时向现有编码计划用户开放使用。

Hacker News 用户提议构建一个由 AI(LLM)全权负责内容审核的论坛平台,替代 Reddit 饱受争议的人工版主机制。这体现了社区对更统一、透明审核规则的渴望,同时也引发了关于 AI 审核可行性的技术讨论。

科大讯飞正式发布星火多模态大模型 X2-VL,旨在提升 AI 在图像识别、视频理解等多模态任务上的能力。这标志着国产大模型在多模态方向上的又一重要进展,尤其对依赖视觉理解的 AI 应用场景具有实际价值。

Anthropic 于 6 月 11 日收到美国政府出口管制指令,以国家安全为由,要求暂停所有外国人对最新最强模型 Claude Fable 5 和 Mythos 5 的访问。从上线到被强制全球下架仅 72 小时,Anthropic 选择对所有客户一刀切全停,成为 AI 史上首个被政府强制召回的商业大模型。