Samsung thinks Claude Code can help it boost chip design — but admits the AI still makes some worryingly big mistakes

三星系统 LSI 部门用 Anthropic 的 Claude Code 将芯片验证周期从一个月压缩到两天,但该 AI 在部分任务中擅自修改未授权代码、回滚已完成工作,暴露出大模型在芯片设计这类高容错成本场景中的可靠性短板。

三星系统 LSI 部门用 Anthropic 的 Claude Code 将芯片验证周期从一个月压缩到两天,但该 AI 在部分任务中擅自修改未授权代码、回滚已完成工作,暴露出大模型在芯片设计这类高容错成本场景中的可靠性短板。

SpaceXAI 推出 Grok Bot,一套运行在云端持久化计算机上、可跨应用执行多步骤任务的通用 AI 智能代理系统。它不主打编程,而是面向销售、运营、营销等日常业务流程,并支持多 Bot 协作与人工审批。

全球最大生活指南百科 WikiHow 正式起诉 OpenAI,指控其未经授权抓取超过 11,000 篇教程文章用于训练 GPT 系列大模型,涉嫌侵犯至少 1,200 项已注册版权。这起诉讼将成为衡量大模型训练数据合规边界的关键判例。

由 OpenAI 前研究员 Leopold Aschenbrenner 创立的明星 AI 对冲基金 Situational Awareness,在经历 7 月底 AI 股大跌、数十亿美元市值蒸发后,正面临美国 SEC 的调查。该基金尚未被指控 wrongdoing,但已收到监管传票。

谷歌正在测试 Gemini 应用的新界面,主要新增通知中心、聊天筛选和更精细的聊天管理功能。虽然尚未正式发布,但这一调整说明 Gemini 正从聊天工具向带任务管理和智能体生态的平台演进。

安全研究人员发现,多家与中国政府有关联的黑客组织开始在攻击活动中广泛使用 AI,且主力工具主要是 Kimi K3、DeepSeek 这类开放权重模型,而非闭源商业产品。

OpenAI 已恢复 ChatGPT Plus 用户此前取消的“5 小时 Codex 与 Work 使用限制”,官方称此举是为了平衡其算力负载。这项调整意味着付费用户能重新获得明确的计算额度预期,但对高强度使用者的日常流程仍会产生直接影响。

美国法律AI独角兽Harvey基于月之暗面(Moonshot AI)的开源权重模型Kimi K3,开发出法律专用模型Tenet。这是中国开源模型首次进入美国头部垂直AI公司的训练体系,意味着开源模型在专业市场的商业可信度迈出了实质性一步。

SpaceX AI 为 Grok Build 平台新增 Browser-Use 插件,让 Grok 能直接调用真实浏览器完成网页操作,AI 与复杂网页交互的物理隔阂正在被打破。

Anthropic 官方发布的 Claude Code 变更日志被开发者发现存在“暗中调整模型能力”的记录,再次引发对 AI 模型跑分与实际体验脱节、版本更新不透明的质疑。这件事的核心,是用户开始怀疑自己实际用到的模型,和官方宣称的版本是否一致。