Show HN: 将DeepSeek蒸馏到GPT-OSS不会转移审查机制。试试看

CTGT Inc.通过实证研究发现,将DeepSeek等中国大模型的审查机制通过蒸馏(knowledge distillation)转移到GPT-OSS等美国基座模型上,审查机制本身并未“转移”。这一结论挑战了业界对“蒸馏中国模型会传播政治审查”的安全担忧,并提供了一个开源评估框架LineageEval以供验…

CTGT Inc.通过实证研究发现,将DeepSeek等中国大模型的审查机制通过蒸馏(knowledge distillation)转移到GPT-OSS等美国基座模型上,审查机制本身并未“转移”。这一结论挑战了业界对“蒸馏中国模型会传播政治审查”的安全担忧,并提供了一个开源评估框架LineageEval以供验…

Hacker News 上的一篇讨论指出,LLM 在写代码上的实际提效可能只有 2 倍,而非宣传的 10 倍。核心争议在于:即便有了 LLM,软件开发中非编码环节(需求理解、测试、评审)的耗时并未大幅减少,而 LLM 降低的门槛正在导致大量“废弃代码”泛滥,对开源生态造成隐性冲击。

Google 将最新的图像生成模型 Nano Banana 2 集成到 Google Earth 网页版,用户输入文本即可将卫星和 3D 地图场景重新“绘画”成任意想象画面,比如百年前的城市或社区新设施。这是大模型在三维地理空间领域的一次落地尝试,直接降低了普通人用 AI 改造真实地图的门槛。

GitHub 于 2026 年 7 月 30 日正式关闭了 GitHub Models 服务,包括模型目录、Playground 和推理 API 全部下线。这意味着开发者不能再通过 GitHub 直接试用和调用第三方模型,微软正将 AI 入口收拢到自家 Foundry 平台和 GitHub Copilot 中…

Google DeepMind 发布 Gemini Robotics 2,新模型能控制人形机器人的全身运动(从脚趾到手指),并支持更精细的五指操作和多机器人协作。这是向通用型家用或工业机器人迈出的实际一步,但运动速度仍需提升。

一位开发者针对Kimi K3模型“想太多、成本高、输出慢”的痛点,发布了一段简短Prompt(工作合同),通过明确任务边界和终止条件,让K3在保持性能的同时减少无效推理,显著降低API调用成本。对大模型用户来说,这是一个低成本提升模型实用性的实操技巧。

英国AI云服务商Nscale以16.5亿美元收购Anyscale,后者是开源分布式框架Ray背后的公司。这笔交易让Nscale从底层算力延伸到工作负载管理软件层,试图在日益拥挤的AI基础设施市场中构建更完整的垂直栈。

RadixArk 与 Google Cloud 宣布合作,将开源推理框架 SGLang 的完整功能带到 Google TPU 上,开发者未来可像使用 GPU 一样,用同一套 API 在 TPU 上运行主流大模型,并有望实现新模型“GPU 发布当天即支持 TPU”。

Meta和微软同期发布财报,两家都在大举押注AI,但投资者给出了截然不同的反应。Meta支出近乎翻倍、自由现金流骤降,股价盘后跌近10%;微软AI投入带来Azure和Copilot的明确回报,股价涨近8%。市场用钱投票:AI支出可以,但必须看到可量化的回报。

Meta在2026年第二季度披露了总额2790亿美元的未来租赁协议,专门用于AI数据中心,且未体现在当前资产负债表上,金额比上一季度暴增53%。这揭示了全球头部AI公司正在以“租赁”形式锁定未来数年算力,其对数据中心基础设施的长期投入远超外界预期。