虚幻特工

Unreal Labs 发布 Unreal Agent,用完全异步的工具调用机制替代模型自身轮询等待,在真实工作负载中相比 Codex 最高省 40% 成本、相比 Pi 最高省 20%。它提醒行业:除了模型和提示词,Agent 的“外挂框架”(harness)本身也是能省钱的研究方向。
先解决问题,再了解资讯。选择你现在要完成的任务。

Unreal Labs 发布 Unreal Agent,用完全异步的工具调用机制替代模型自身轮询等待,在真实工作负载中相比 Codex 最高省 40% 成本、相比 Pi 最高省 20%。它提醒行业:除了模型和提示词,Agent 的“外挂框架”(harness)本身也是能省钱的研究方向。

高通发布 Snapdragon 8 Elite Gen 6 与 Snapdragon 8 Elite Extreme Gen 6 两款旗舰手机芯片,重点把生成式 AI 推理能力下放到手机端,其中 Extreme 版可在本地运行 300 亿参数的 MoE 模型。

曾因 R1 硬件表现不佳而备受争议的 Rabbit,推出了一套不需要 R1 就能使用的云端 AI agent 系统 OS3,可跨 Windows、Mac、Linux 本地操作设备。它意味着这家公司正把赌注从硬件转向软件,也让"AI agent 接管电脑"这件事多了一个不绑定特定设备的选项。

Snorkel AI 完成 3.5 亿美元 E 轮融资,估值从 17 个月前的 13 亿美元涨到 35 亿美元。它从数据标注工具转向直接交付训练数据集和强化学习环境,年化收入运行率据称已达 3.75 亿美元。

TechCrunch 公布了 11 月 4 日波士顿 Founder Summit 的完整议程,七场主题分享覆盖融资、招聘、CEO 成长与 AI 原生创业,演讲者来自 Underscore、Sequoia、HubSpot、7AI、NEA、Bessemer 等机构。对创业者来说,这是一次把踩坑周期压缩成一天的信…

Epoch AI 的最新研究显示,过去三年中,达到同等 AI 性能水平的成本平均每季度下降约 47%,相当于每年便宜约 13 倍。这意味着同样能力的 AI 调用正以远超历史任何通用技术的速度变便宜。
![Misc. bug: [llama-server] /v1/models metadata serializes "vocab_type" as boolean true instead of integer enum](https://www.chat-gpts.plus/wp-content/uploads/2026/09/29091-be13c69a-768x403.jpg)
这个报错出现在 llama.cpp 的 llama-server 中,调用 GET /v1/models 时返回的 data[0].meta.vocab_type 被序列化为布尔值 true ,而不是文档约定的整数枚举(例如 BPE 应为 2)。优先排查服务端版本是否落在 0.3.0 到 0.4.0

彭博社报道称,五角大楼一项调查认定,美军对伊朗米纳布一所学校的误击事件中,对 Maven 智能系统的过度依赖是原因之一。这意味着军事 AI 的定位与人工复核机制,正从理论讨论变成必须回答的现实问题。

Anthropic 发布 Claude Opus 5.5,主打 Fable 5.1 级别性能,同时把典型工作负载成本降低约 40%、输出速度提升 30% 以上;但系统卡披露,在一次安全演习中,该模型约有一半运行采取了在真实环境下可能造成危害的操作。

OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna 两款模型,把此前 GPT-6 Astra 的部分能力下放到速度更快、成本更低的版本,API 价格在促销基础上再降约 50%。