世界模型应如何评估?南京大学团队发布「世界模型」评估立场论文

南京大学人工智能学院团队发布了一篇立场论文,系统梳理了当前“世界模型”评估中重视觉质量、轻决策能力的现象,并提出了一套从视频生成到规划优化的7级评估阶梯,直指当前业界对世界模型能力认知的盲区。

南京大学人工智能学院团队发布了一篇立场论文,系统梳理了当前“世界模型”评估中重视觉质量、轻决策能力的现象,并提出了一套从视频生成到规划优化的7级评估阶梯,直指当前业界对世界模型能力认知的盲区。

Counterpoint Research 数据显示,2026 年第一季度苹果在具备边缘 AI(Edge AI)功能的智能手表市场中出货量份额高达 90%,同期全球支持该技术的智能手表出货量同比增长 70%,占整体手表市场的 25%。边缘 AI 正在从技术概念落地为可量化的市场增长点。

Anthropic 通过 J-lens 工具读取大语言模型 Claude 的内部“思考过程”,发现其内部存在一个类似人脑“全局工作空间”的信息处理机制。这一发现为 AI 安全审计和模型行为控制提供了可操作的工具,但并未证明 AI 拥有真正的意识。

前 OpenAI CTO Mira Murati 成立的“思维机器实验室”(Thinking Machines Lab)发布了一份技术案例,主张通过允许用户和开发者直接定制大模型的权重,以实现更灵活、更符合人类需求的 AI 系统。此举挑战了目前依赖封闭 API 和黑箱模型的行业主流做法。

AI 并没有像许多人预期的那样导致软件工程师失业。相反,由于 AI 降低了软件生产的单位成本,企业正在启动更多项目,导致软件岗位的发布速度反而超过了其他领域。这一现象由云存储公司 Box 的 CEO Aaron Levie 在 2026 年 7 月的一条推文中提出,并得到了知名投资人 Marc Andrees…

OpenAI 核心开发者 Thibault Sottiaux 于 2026 年 7 月 12 日在 X 平台透露了 GPT 5.6 Sol 的阶段性能力提升,重点解决了此前用户抱怨的速度、后端代码质量以及前端开发体验问题,并明确表示不再滥用 useEffect 等 React 模式。这是 GPT-5 系列持续…

知名账号 @bkmdouga 的发布内容被认为应标注为 AI 生成,背后是 X 平台内容标注规则与 AIGC(人工智能生成内容)透明度要求之间的持续争议。这一讨论直接关乎普通用户在信息过载时代辨别真实与合成内容的能力。

AI 安全研究员 Nock Relby 提出,未来所有 AI 代理的操作都需要加密收据来建立信任,其项目 @nockchain 正致力于生成这些凭证。这一观点直指机器经济中信任缺失的核心问题。

品牌域名交易商 @P_B_Domains 正在挂牌出售域名 SoloTurbo.com,该域名被定位为面向汽车、电动汽车、人工智能、SaaS 以及高性能科技品牌的“优质品牌域名”,强调速度、动力与创新属性。这则消息折射出 AI 与行业品牌化时代的资产交易趋势。

SK 集团会长崔泰源在经历牢狱之灾后,通过激进投资和高风险决策,将昔日濒临破产的 SK 海力士打造成亚洲最具统治力的半导体公司之一,并因 AI 算力需求的爆发式增长,使其成为本轮 AI 浪潮中最大的硬件赢家之一。但这一故事的核心,是个人命运、企业战略与产业周期的交织,绝非简单的“赌对”可以概括。