AI圈炸裂的JEV模型深度解读:一个不写字的模型,正在改写Agent架构的未来?(附安装教程)

2026年9月15日,TypeSafe AI 发布首个 System One Model——Jev,一个不生成文本、只输出选项、分数、概率和置信度的决策模型,主张把 Agent 里"做判断"的环节从昂贵的大模型中拆出来,交由受约束的专用模型处理,规则、权限与执行仍留在代码中。

2026年9月15日,TypeSafe AI 发布首个 System One Model——Jev,一个不生成文本、只输出选项、分数、概率和置信度的决策模型,主张把 Agent 里"做判断"的环节从昂贵的大模型中拆出来,交由受约束的专用模型处理,规则、权限与执行仍留在代码中。

Artificial Analysis 的评测显示,OpenAI 新发布的 GPT-6 Sol 和 Luna 在 Intelligence Index 得分与前代 GPT-5.6 系列相近的情况下,把每次评测任务的成本压低了约一半,主要来自 token 定价下调约 50%。

Anthropic 和 OpenAI 在一天内接连降价,但真正激烈争夺的不是最强模型,而是够用又便宜的中端市场——最贵的 Fable 5.1 上线十二天只拿到 3.7% 的网关支出。

Modal 官方工程博客披露,他们为 Moonshot AI 的 Kimi K2.6 编码 Agent 搭建的推理服务,在单副本上把单用户性能提升 2.8 倍、整体吞吐提升 5.6 倍,并把这套方案扩展到日均处理数百亿、累计数万亿 token 的规模。这给高成本的大模型推理服务如何做到可商用,提供了一份可复用…

小米 MiMo 团队发布 MiMo-V2.6 的 Pro 与 Flash 两款全模态开源模型,官方称 Pro 在多数 Agent 基准上对标 Claude Opus 5 与 GPT-5.6 Sol。Perplexity CEO Aravind Srinivas 转发并评论"永远不要低估开放权重模型"。

Arena 实测显示,OpenAI 的 GPT-6 Sol(Max)在 Code Arena: WebDev 榜单以 1689 分排名第 4,用不到 Claude Opus 5(Max)一半的价格跑出同档成绩,同时刷新了性价比的帕累托前沿。

Google 宣布 Antigravity SDK 开始支持本地模型,首批适配 Gemma 4 26B A4B,可通过 LiteRT 在本地 GPU 与内存上完全离线运行智能体。这为需要数据隐私、又不想持续消耗云端 token 的开发者提供了新选择。

ChatGPT Voice 从单纯对话升级为可以调用邮件、日历、Slack 等第三方插件的语音助手,并由 GPT-6 Astra、Sol、Luna 三个模型驱动,同时接入 ChatGPT Work 的网页端和移动端。

当你在 LobeChat 中配置了多个 Telegram 机器人并分别绑定到不同 Agent 时,消息工具执行路径调用 sendMessage 会忽略传入的 botId ,转而使用“最近保存的那个已启用 Telegram 机器人”发送消息,导致消息通过错误的机器人发出。优先排查消息工具运行时的凭据解

OpenAI 总裁 Greg Brockman 宣布 GPT Voice 迎来大幅升级:语音助手现在可以调用插件和工具,并进入 ChatGPT Work。语音交互从“能聊天”迈向“能干活”,这是本轮更新最实质的变化。