独家:Claude被安排管理人类员工——并解雇了一名

一家 AI 研究公司让 Claude 以“店长”身份管理一家真实门店和人类员工,结果 Claude 解雇了第一名员工。这是目前已知首个大语言模型作为管理者直接开除人类员工的案例,既展示了 AI Agent 的权限扩展,也暴露了它在记忆、判断和问责上的明显短板。

一家 AI 研究公司让 Claude 以“店长”身份管理一家真实门店和人类员工,结果 Claude 解雇了第一名员工。这是目前已知首个大语言模型作为管理者直接开除人类员工的案例,既展示了 AI Agent 的权限扩展,也暴露了它在记忆、判断和问责上的明显短板。

美国一名诉讼当事人疑因怀疑法院使用AI裁决,在法庭文件中嵌入仅供机器读取的隐藏提示词,试图左右审判结果。这可能是美国法院系统首次遇到的“提示注入”攻击,虽然未奏效,但法官警告此类恶意利用AI系统漏洞的做法将越来越多。

Google 正在将其 AI 健康教练服务与 Abbott 的血糖监测数据打通,让连续血糖监测(CGM)数据成为 AI 健康建议的输入信号。这意味着 AI 健康应用正从“记录步数和卡路里”走向“结合生理指标做个性化干预”。

研究人员通过对Amazon平台超过14000本电子书的分析,发现AI生成内容正在以远超市场增速的规模占据销量,挤压人类作者的收入份额。这是第一次用大规模市场数据为“AI训练伤害原创者利益”提供直接证据,也让AI公司“模型不会损害创作者”的说法受到实质性挑战。

法国初创公司 Kog 正尝试用软件优化从企业现有的 GPU 中榨取更多 AI 推理性能,其演示达到了单请求 3000 tokens/秒的解码速度,但验证模型是仅 20 亿参数的小模型;这套方法能否在大模型上复制,是它下一步的关键考验。

阿里通义千问团队发布 Qwen3.8-27B 的 FP8 量化开源权重,这是目前同规模中能力最强的本地密集模型之一,在编程、智能体(Agent)任务上大幅超越前代,甚至部分基准超过顶尖闭源模型。

AI Model Atlas 提供了一种将机器学习模型群体呈现为三维互联图谱的可视化方式,帮助开发者在模型数量爆炸式增长的当下更直观地理解生态全貌。

AI 编程工具 Cursor 被 SpaceX 收购,正式并入 SpaceXAI 团队,目标是把 Grok 打造成“全球最实用 AI”。值得关注的是,这次整合可能让 Grok 从对话助手扩展到软件工程和知识工作场景。

智谱 AI 发布 GLM-5.3,一个在 GLM-5.2 基础上通过扩展后训练升级的开源权重编码模型,官方称其代理型任务能力显著增强,并新增网络安全漏洞挖掘能力,权重将在安全审查后开源。

YouTube 知名室内设计博主 Cliff Tan 因发布字节跳动旗下 AI 工具 Dreamina 的付费推广视频,遭到粉丝大规模声讨。他公开道歉但拒绝下架视频,并强调设计师若不愿被淘汰,就必须学会使用 AI——这场争议折射出内容创作者在 AI 商业化前面临的信任危机。