微软新版AI规则手册拒绝了其50亿美元合作伙伴正在开展的研究

微软发布了一份约束自家 MAI 模型的 AI 行为准则,明确否决“模型可能值得被赋予福利或权利”这一说法;而它投资 50 亿美元、同时在云和 Office 产品上深度合作的 Anthropic,恰好正在研究这个方向。

微软发布了一份约束自家 MAI 模型的 AI 行为准则,明确否决“模型可能值得被赋予福利或权利”这一说法;而它投资 50 亿美元、同时在云和 Office 产品上深度合作的 Anthropic,恰好正在研究这个方向。

OpenAI 欧洲、中东和非洲地区政策负责人 Tom Duff Gordon 公开呼吁英国出台具有约束力的 AI 监管规则,建立"持久、强制、基于能力"的要求。这意味着头部大模型公司开始主动为监管背书,而不是被动等待立法。

中国监管机构正把目光投向以“AI男友”“AI女友”为代表的陪伴型聊天机器人,相关合规要求可能影响国内一批情感陪伴类 AI 应用的上线节奏与产品形态。

OpenAI 和 Anthropic 近期讨论的“放缓前沿训练”,表面上是减速,实则可能把闲置算力和研究精力转向后训练、Agent 可靠性与安全对齐,从而更快推动大模型在真实产品中的落地。

快船老板 Steve Ballmer 就 Kawhi Leonard 合同违规事件公开道歉,并接受 NBA 开出的联盟史上最大罚单——5 个首轮签、3000 万美元罚款、本人禁赛一年。这场从播客调查发酵到司法介入的风波,正在给体育圈的合规与数据调查方式立下新样本。

一位 Medium 作者 RDX 发帖抱怨 Claude 在执行指令时反复"唱反调":即便在 CLAUDE.md 中明确要求不要自相矛盾,它仍会在代码、文档、内容创作中强行加入平衡性表述或额外改动。该帖登上 Hacker News,引发不少开发者共鸣。

一篇在 Hacker News 上引发讨论的文章提出,部分 AI 领袖反复强调“AI 可能毁灭人类”的末日叙事,本质上也是一种市场炒作手段,用来争取监管话语权和资本关注。

MIT 团队提出 HardFlow,让 flow matching 类生成模型只在生成终点强制满足硬性安全约束,不必每一步都合规,从而在保证规则不被违反的同时提升输出质量,且无需重新训练模型。

瑞典斯德哥尔摩的 Tandem Health 完成了 1 亿美元 B 轮融资,它做的是一款面向临床医生的 AI 副驾驶,在问诊过程中自动生成病历记录。值得关注的是,资本正在押注“医疗文书自动化”这个具体而高频的场景,而不是泛医疗大模型。

安全研究者在 DEF CON 34 上演示了如何通过伪造邮件头、提示注入和上下文操纵,入侵企业 AI 客服 Agent,并借此绕过 MFA、窃取 OTP。这类攻击在几个周末内带来了超过 5 万美元的漏洞赏金。