Thinking Machines 押注效率而非规模,推出第二款模型 Inkling Small。

Mira Murati 创立的 Thinking Machines 发布了更小但更高效的推理模型 Inkling Small,在部分测试中反超自家旗舰模型,同时把参数规模压缩到原来的三分之一以下。它试图证明“小而精”的推理路线同样有竞争力。

Mira Murati 创立的 Thinking Machines 发布了更小但更高效的推理模型 Inkling Small,在部分测试中反超自家旗舰模型,同时把参数规模压缩到原来的三分之一以下。它试图证明“小而精”的推理路线同样有竞争力。

AI正在同时增强网络攻击与防御两端的能力——攻击者用AI将攻击效率提升到国家级水平,而防御方也开始用AI做动态响应。前GCHQ专家Julian Richards指出,真正的韧性不是一次性的安全方案,而是持续变化、多样化、动态调整的防守策略。

据 Hacker News 讨论帖,AI 模型“GPT-5.6 Sol”对 Maxwell 猜想给出了反例,使其被证伪。这一事件之所以值得关注,不仅在于结论本身,更在于它把“AI 在数学研究中解决什么级别的问题、解决得有没有意义”重新摆上台面。

DeepSeek 于 7 月 31 日发布 V4 Flash 0731 迭代版本,在 Artificial Analysis 智能指数上拿下 50 分,比 4 月版提升 10 分,与 GPT-5.6 Luna 仅差 1 分,但 API 单任务成本约低 60%。同等价格下性能大幅跃升,是这次更新最值得关注的点。

多方线索显示 DeepSeek V4 正式版可能于 8 月 3 日发布——硅基流动平台当天将调整 V4 Pro 缓存价格,部分 API 也已提前展现了更强的能力。若消息属实,这将是近期开源大模型领域最关键的一次版本落地。

荷兰保险公司Univé没有把ChatGPT Enterprise当作普通IT工具部署,而是通过领导层定方向、治理给安全感、员工自主创造的方式,让约1500个自定义GPT和日常AI工作流进入核心业务。值得关注的是,它提供了“AI落地不是买工具,而是建组织能力”的参考样本。

OpenAI在欧盟《人工智能法案》进入新实施阶段时,公开了其安全、透明度和内容溯源方面的合规路径,并参与了两项欧洲AI实践守则。这是头部大模型公司主动适应区域监管的典型动作,值得关注。

Simon Willison 发布了一个名为 llm-chat-completions-server 的新插件,让本机安装的任意 LLM 模型能通过 OpenAI Chat Completions 兼容接口对外提供服务。背后的亮点是 LLM 0.32rc1 引入的“内容可寻址日志”机制,用哈希去重多轮对话里的…

OpenAI 在 7 月 31 日宣布对 GPT-5.6 系列中端和轻量级模型大幅降价,其中面向批量轻量推理场景的 Luna 模型输入输出价格同步下调 80%,直接对标 DeepSeek V4 Pro 的低价策略,第三方评测显示降价后 Luna 的综合性价比已反超对手。

OpenAI 宣布 GPT-5.6 系列中轻量级模型 Luna 的 API 输入输出价格大幅下调 80%,在同等任务下综合性价比反超 DeepSeek V4 Pro,这是其价格体系首次直接对标国内高性价比大模型。