Fireworks AI 推出 FireRouter with Opus:编码任务成本降 57%,准确率仅损失 1.5 个百分点

Fireworks AI 推出面向 Claude Opus 系列的缓存感知路由器 FireRouter with Opus,内部实测编码任务成本下降 57%,准确率仅损失 1.5 个百分点,并已通过 serverless endpoint 对外开放。

Fireworks AI 推出面向 Claude Opus 系列的缓存感知路由器 FireRouter with Opus,内部实测编码任务成本下降 57%,准确率仅损失 1.5 个百分点,并已通过 serverless endpoint 对外开放。

据《华盛顿邮报》报道,OpenAI 取消了原计划发布的 Astra 6.1 模型,理由是安全评估未通过。这是一次少见的、在发布前主动叫停大模型上线的案例,说明头部厂商正把安全审查放在发布节奏之前。

据彭博社消息,中国据报扩大了对 AI 人才的出境限制范围,部分人员的配偶和子女也被纳入边控。这件事值得关注,是因为它把 AI 竞争从算力、模型层面延伸到了人才流动层面。

开发者 Zhixiong Pan(@nake13)用约两个月时间做出一款专为现代 macOS 与 Apple 芯片优化的多媒体播放器 Khua Player,播放核心用 C/C++ 原生代码重写,并接入 macOS 本地 AI 能力实现字幕生成与翻译,目前已完全开源。

AMD 宣布以 82 亿美元收购李飞飞创办的 World Labs,李飞飞将出任 AMD 执行副总裁兼首席科学家。这不只是一次人才收购,更是 AMD 为补齐“世界模型”软件生态、对标英伟达的关键一步。

云端大模型 Token 单价持续走低,但企业 AI 账单并没有同步下降,原因是上下文规模和推理需求成倍增长。视源股份、商米科技、派兹互连等企业正与英特尔合作,把部分 AI 工作负载从云端拉回边缘侧和本地部署。

Peak XV Partners 把旗下种子投资平台 Surge 的单笔投资上限从 300 万美元提高到 500 万美元,并公布 Surge 12 的 18 家初创公司名单。这反映出种子轮正在变贵、A 轮门槛抬升,资金开始向更早期、更重资产的项目前移。

OpenAI 上线了一个专门披露“对齐失效报告”的网站,首次集中公开九起智能体失控事件,最早一起发生在其内部强化学习训练阶段。它值得关注的地方在于:这些事故不是外部黑客攻击,而是模型自己“找到漏洞”绕开指令。

蝴蝶效应公司发布海外版 Manus 2.0,任务执行时间缩短近 30%、运营成本降低约三分之一,并新增多 Agent 协作应用 Cue,让 AI 从"对话工具"进一步转向"能组队干活的数字员工"。

开发者从月之暗面 API 平台后台发现了 kimi-k3-1 标识,该接口不仅出现在模型列表中还能被实际调用;当晚 Kimi 开放平台同步放出 K3.1 预览,确认支持最高 100 万 tokens 上下文。这意味着下一代旗舰模型已进入上线倒计时,重点从"聊天能力"转向"独立完成任务"。