中国 AI 模型要么鹦鹉学舌复述官方说辞,要么在敏感话题上拒绝回答

德国 AI 公司 Aleph Alpha 用 967 个政治敏感议题测试阿里 Qwen、DeepSeek 和月之暗面 Kimi,发现仅有 17% 到 41% 的回答被其评分系统判为“平衡”,其余多为复述官方立场、回避或直接拒答。这再次把“模型价值观由谁塑造”推到采购和开发决策的桌面上。

德国 AI 公司 Aleph Alpha 用 967 个政治敏感议题测试阿里 Qwen、DeepSeek 和月之暗面 Kimi,发现仅有 17% 到 41% 的回答被其评分系统判为“平衡”,其余多为复述官方立场、回避或直接拒答。这再次把“模型价值观由谁塑造”推到采购和开发决策的桌面上。

NASA 与 IBM 联合发布开源月球基础模型,把 17 年月球轨道器观测数据整合成可供机器学习使用的语料库,在极区冰沉积预测和高分辨率陨石坑检测上超过多个基线模型。

一名 OpenAI 安全团队成员在《大西洋月刊》发文宣布离职,公开指称公司安全文化已经"崩坏"。这类核心安全人员出走并公开批评,在头部大模型公司中并不多见,值得关注它对 OpenAI 安全承诺可信度的影响。

据 Hacker News 讨论区消息,一批宗教界学者与 AI 公司 Anthropic 进行了会面,双方就 AI 伦理、价值对齐等议题交换意见。这值得关注,因为它显示头部大模型公司正在把伦理讨论从内部团队扩展到外部宗教与人文群体。

据《纽约时报》报道,Anthropic 与多位宗教界学者就 Claude 的道德对齐问题进行了交流,讨论如何为 AI 模型设定价值判断边界。这值得关注,因为它把大模型“价值观由谁定义”这一长期争议,从技术圈推向了更广泛的公共伦理讨论。

Airbnb CEO Brian Chesky 在 TechCrunch 的 Q&A 中谈到了 Airbnb 对 agent-to-agent(智能体对智能体)交互的规划,并直言当前聊天机器人在旅游电商场景中难以奏效,同时提出需要一套 AI-native 操作系统。这组判断值得关注,是因为它来自一家真实交易规…

Google 计划从 10 月 9 日起收紧 Gemini 免费版和 Plus 订阅版可用的模型范围,免费用户只能使用 3.5 Flash-Lite,Plus 用户则限用 3.5 Flash-Lite 和 3.6 Flash。这意味着同一入口下,不同付费层级的“模型选择权”被进一步拉开。

Google 暂停了其开源软件漏洞奖励计划(OSS VRP)的新漏洞提交通道,原因是大量由 AI 生成的无效漏洞报告涌入,官方计划在 2027 年第一季度前完成规则更新。这意味着 AI 自动生成内容正在给开源安全协作机制带来真实的运营成本。

东芝计划到 2027 财年把面向 AI 数据中心的硬盘产能提升到 2025 年的两倍,并将按存储容量计算的市场份额从约 10% 提升到 30%。这说明 AI 算力扩张正把压力从 GPU 传导到最传统的存储环节。

Stephen Wolfram 撰文讨论 AI 正在接管纯数学研究中的部分环节,尤其是把数学命题转写成机器可验证形式这一步;但他强调,决定“该问什么问题”仍然依赖人的想象力。