标签: Anthropic

7.13—7.19|本周 AI 论文精选

7.13—7.19|本周 AI 论文精选

本周 AI 社区聚焦两篇高质量研究综述——一篇系统梳理了“自我改进智能体”的技术框架与演化路径,另一篇则从头开始探讨 LLM 的“元认知”能力。两者共同指向一个趋势:AI 正从“执行指令”向“自我反思与迭代”进化。

AI 发展了 4 年,把应用发展没了?| 42章经

AI 发展了 4 年,把应用发展没了?| 42章经

2026 年 7 月,42章经发文指出,国内 AI 应用市场陷入冰点,多家投资机构明确表示“不看应用、应用赛道已死”,与此同时模型层却达到阶段性最强。这一现象背后,是模型能力快速上升但应用层始终缺乏规模化付费场景的矛盾,尤其在国内市场表现突出。

AI开始赌球会怎样?

AI开始赌球会怎样?

一家名为Obside的初创公司用了一个非常规的基准测试——让ChatGPT、Gemini、Claude等主流AI模型用虚拟资金押注世界杯比赛,以衡量它们在不确定性环境下的判断能力。结果显示,Mistral目前领先,而Claude Opus 4.8是唯一亏损的模型。