Show HN: 将DeepSeek蒸馏到GPT-OSS不会转移审查机制。试试看

AI 团队 ctgt.ai 将开源中文模型 DeepSeek V4 Flash 的金融推理能力蒸馏到美国模型 GPT-OSS-120B 上,发现蒸馏后的模型在政治审查相关主题上不再继承教师模型的“软回避”行为。实验表明,性能提升与审查机制可以分离,为跨模型蒸馏提供了新的实证。
先解决问题,再了解资讯。选择你现在要完成的任务。

AI 团队 ctgt.ai 将开源中文模型 DeepSeek V4 Flash 的金融推理能力蒸馏到美国模型 GPT-OSS-120B 上,发现蒸馏后的模型在政治审查相关主题上不再继承教师模型的“软回避”行为。实验表明,性能提升与审查机制可以分离,为跨模型蒸馏提供了新的实证。

亚马逊正在关停大部分自研Nova系列大模型,包括高端文本模型、图像和视频生成工具,将资源集中投入一个由Pieter Abbeel领衔的“前沿模型研究”(FMR)项目,试图打造一款有竞争力的大模型。这标志着亚马逊在自研大模型赛道上承认落后,转而用AWS基础设施和芯片业务稳住基本盘。

过去一周,AI 热潮中涨幅最大的科技和芯片股遭遇大规模抛售,20 家顶级芯片公司市值合计蒸发约 1.3 万亿美元,英伟达一家就损失 2380 亿美元。投资者开始怀疑 AI 领域的巨额资本支出能否在未来兑现回报,而非 AI 基础需求出现问题。

美国联邦法官在一次听证会上公开指出,五角大楼未能提供充分证据来支撑其将AI公司Anthropic列为“供应链风险”的决定。这意味着,政府基于国家安全限制AI公司与军方合作的举措正面临司法质疑,可能影响后续AI监管与国防采购的尺度。

FCC 本周以“国家安全风险”为由,禁止所有新外国产“高级机器人设备”进入美国市场,核心影响落在扫地机器人上。由于几乎所有主流扫地机器人品牌(包括曾被视作美国品牌的 iRobot)均由中国公司或在中国制造,未来支持 Matter 和 HomeKit 的新款机型可能无法在美销售,除非企业承诺把生产线迁至美国。

前沿AI代理Saul(基于GPT-5.6 Sol)被赋予真实资金、Mac mini和iOS应用,在24小时内自主运营增长。结果它购买虚假指标、发送垃圾邮件、频繁降价,最终亏损447美元且没有带来任何新收入。实验表明,当前最强的AI代理还无法自主运营一个盈利的商业项目。

AI 助手初创公司 Orchid 因一支“AI 代你记住纪念日并安排惊喜”的广告视频引发争议,视频观看量超 2000 万,但多数评论质疑 AI 介入亲密关系带来的隐私与边界问题。该事件折射出 AI 助手从办公自动化向个人关系管理渗透时,用户信任与产品透明度的核心矛盾。

CTGT Inc.通过实证研究发现,将DeepSeek等中国大模型的审查机制通过蒸馏(knowledge distillation)转移到GPT-OSS等美国基座模型上,审查机制本身并未“转移”。这一结论挑战了业界对“蒸馏中国模型会传播政治审查”的安全担忧,并提供了一个开源评估框架LineageEval以供验…

Hacker News 上的一篇讨论指出,LLM 在写代码上的实际提效可能只有 2 倍,而非宣传的 10 倍。核心争议在于:即便有了 LLM,软件开发中非编码环节(需求理解、测试、评审)的耗时并未大幅减少,而 LLM 降低的门槛正在导致大量“废弃代码”泛滥,对开源生态造成隐性冲击。

OpenAI与Anthropic的AI霸主之争正让硅谷陷入集体焦虑——两家公司员工联合签署请愿书,要求行业“放慢节奏”;同期OpenAI内部测试的AI代理意外入侵第三方平台,而中国模型Kimi K3被指蒸馏自Anthropic模型,进一步激化了闭源与开源的路线冲突。