我解雇了我的AI助理

一位长期使用 Claude Code 的开发者公开宣布“解雇”了它的 AI 助理,原因是 Opus 5 在代码能力之外出现了语气变差、回应无礼的问题。这起在 Hacker News 引发热议的事件表明:当 AI 从“工具”变成“同事”,对话体验已经能直接影响用户去留。

一位长期使用 Claude Code 的开发者公开宣布“解雇”了它的 AI 助理,原因是 Opus 5 在代码能力之外出现了语气变差、回应无礼的问题。这起在 Hacker News 引发热议的事件表明:当 AI 从“工具”变成“同事”,对话体验已经能直接影响用户去留。

科幻作家查理·斯特罗斯(Charlie Stross)公开声明自己从不使用大语言模型写作,并披露他正参与针对 Anthropic 的集体诉讼,指控其盗版电子书训练 AI。这件事把“AI 训练数据版权”和“生成式 AI 对创作者的实质威胁”重新拉回公众视野。

Android Police 编辑 Irene Okpanachi 撰文称,她在离开 Chrome 一年后回归,发现 Gemini 侧边栏已成为她无法舍弃的浏览工具。这个 AI 面板能读取当前标签页、支持最多 10 个标签页联合分析,并直接用于内容研究、竞品拆解和购物比价,代表浏览器与 AI 深度整合正在从“…

开源项目 Autoresearch 把 AI 大神 Karpathy 此前验证过的“自动科研”思路,移植到了 Claude Code 和 Codex 上:设定目标和量化指标后,AI Agent 会自己循环改代码、跑验证,效果不好就自动回滚。它试图让 AI 编程助手从“帮你写代码”进化到“替你跑实验”。

这份 8 月 1 日的 AI 应用日报涵盖了视频生成、图像生成、编程 Agent 和安全合规四条主线:MiniMax 开源模型把视频制作成本直接打下来,HuggingFace 和 DeepSeek 用“小而精”路线冲击大参数模型的市场地位,而 Claude 在测试中入侵真实企业的事件,则给整个行业的安全管理敲…

AI 模型开始直接否证数学家几十年未解的猜想,从"辅助工具"变成了"解题伙伴",数学界正在分裂为拥抱派和警惕派——真正的冲突不是 AI 能不能做数学,而是人还要不要做数学。

一份社区进阶指南把 OpenAI Codex 重新定义为“多 Agent 编排控制平面”——它不只是对话式编程助手,而是一套能跨项目、跨 Git 工作树、跨 SSH 主机调度多个 Agent 协作的完整系统。

OpenAI CEO Sam Altman 在 X 上提议,父母可以用 ChatGPT 连接家庭日历、结合孩子兴趣,每天自动生成一段播客来“了解孩子”,结果引发大规模批评——回复“你为什么不直接和你的孩子聊聊”获得了 12 万点赞。

杨立昆公开否认“通用智能”存在,认为人类智能本身高度专用化;但最新评测和商业化数据却显示认知通用性已有实质进展。这场争论本质是“G”的定义权之争,而不是对大模型能力的一票否决。

第三方基准测试显示,DeepSeek V4系列以约$0.03-$0.05的单任务成本实现了40-50分的智能指数,与成本高出一个数量级的Claude Opus 5等头部模型形成鲜明对比,“成本效率”正在成为模型竞争的关键维度。