Claude Tag 可能会是下一个现象级 AI 产品。

AI 研究者 Karpathy 将 Claude Tag 视为 LLM 界面交互的第三次重大变化——AI 从网站、电脑应用走向团队即时通讯工具,像同事一样参与协作。这件事值得关注,因为它可能意味着 Agent 产品范式正从“个人助手”转向“团队协作者”。

AI 研究者 Karpathy 将 Claude Tag 视为 LLM 界面交互的第三次重大变化——AI 从网站、电脑应用走向团队即时通讯工具,像同事一样参与协作。这件事值得关注,因为它可能意味着 Agent 产品范式正从“个人助手”转向“团队协作者”。

AI 从业者 @goan999999 用两天时间撰写了一篇基于 Codex 的技术拆解,系统梳理 Agent 的架构、运行逻辑和演变方向。文章的核心判断是:AI 正在从“生成内容”转向“完成任务”,而 Codex 这类 Coding Agent 的关键价值不在于生成更多代码,而是让 AI 真正进入软件开发流程…

据多位用户与内部人士爆料,AI 编程工具 Cursor 本周可能迎来密集更新,包括热门模型 Grok 4.6 上线、自研 Git 平台 Origin 发布,以及 Composer 3 功能更新。目前公开版本仍是 Grok 4.5,传闻尚未获得官方确认。

Google Research 与 DeepMind 在真实模拟问诊中,首次展示了医疗 AI 系统 AMIE 的实时临床视频咨询能力;诊断准确率和沟通质量获得临床评估者认可,但距离实际诊疗落地仍有距离。

台风“海豚”登陆中国前夕,国产AI气象大模型提前五天将登陆时间和地点误差控制在30分钟、30公里内。中国正把AI天气预报从科研竞赛升级为国家级基础设施,与西方顶尖模型的差距正在肉眼可见地缩小。

TechRadar 刊文提出判断 AI 技术栈控制权的五个问题。核心观点是:一家公司能下载模型、在自己的云上运行,并不等于真正掌控 AI 系统;从模型来源、依赖组件到法律合同和退出机制,每一步都需要可验证的能力,否则所谓“自主可控”只是假设。

安全研究者展示了一种针对专有大语言模型 API 的攻击思路:通过精心构造的查询,可以诱导模型暴露内部推理轨迹,从而在未接触权重的前提下,低成本获取闭源模型最核心的“思考过程”。

Spotify 推出 AI Persona 标签,用于区分真实艺术家与 AI 伪造或虚拟的创作者身份,目标是提升平台可信度;但该机制针对的是“人设与身份”而非音频内容本身。

NVIDIA 发布 Nemotron 3.5 Lightning,一个面向长时间运行 AI Agent 的轻量级开源模型(30B 参数、3B 活跃参数),专注工具调用、结果验证等高吞吐执行任务,用低成本换取高速度,同时推出 NeMo Switchyard 路由库,让不同任务自动分发给最合适的模型。

英伟达发布开源 MoE 模型 Nemotron 3.5 Lightning,宣称输出速度最高提升 4 倍,同时推出一个面向 Agent 场景的模型路由工具。开源、快、带路由,是这次发布最值得关注的三件事。