爆料称 DeepSeek 下一波大模型将至:3 万亿参数,性能剑指 GPT-6 Astra

有爆料称 DeepSeek 即将推出代号 Code 2.0 的新模型,参数规模或超 3 万亿,主打 Computer Use 能力,性能目标直指 Mythos 5.1 和 GPT-6 Astra。若属实,这将是国内参数规模最大的大模型之一。
先解决问题,再了解资讯。选择你现在要完成的任务。

有爆料称 DeepSeek 即将推出代号 Code 2.0 的新模型,参数规模或超 3 万亿,主打 Computer Use 能力,性能目标直指 Mythos 5.1 和 GPT-6 Astra。若属实,这将是国内参数规模最大的大模型之一。

开源 AI 编码工具 OpenCode 旗下的 10 美元月费订阅服务 OpenCode Go,已连续两周实现收支平衡。在多数 AI 编码工具仍靠烧钱或卖数据维持的背景下,这意味着低价订阅加开源模型组合,存在走通商业闭环的可能。

智谱于9月13日晚宣布完成约50亿美元新融资,资金将主要投向下一代GLM基础模型、全自训练系统和算力基础设施。其核心目标是把"下一代GLM由上一代GLM训练"变成可运行的递归自我改进循环。

当 Open WebUI 中的多模态 Agent 通过 Open Terminal 的 read_file 查看图片时,上下文计量器会把持久化消息里的 base64 图片数据当作文本按“字符数 ÷ 4”来估算 token,结果单条 tool 消息被算成约 1M “token”,远超引擎实际上下文,从

当你用 RTDetrModel 从检测头 checkpoint(或 SEWDForCTC 从 SEW-D checkpoint)加载权重时,如果日志显示 Loading `RTDetrModel` from a detection checkpoint (or `SEWDForCTC` from a

AI 智能体跑长任务时频繁“失忆跑题”,问题往往不在大模型本身,而在包裹模型的执行框架。AWS、Claude Code、Manus、OpenAI Codex、Amazon Bedrock AgentCore 等正用四套机制把“浅层循环”改造成能处理长任务的深智能体。

微软把 SpaceXAI 的 Grok 模型接入 Microsoft 365 Copilot,Word、Excel、PowerPoint 均可调用,作为 Frontier 项目限量预览向特定客户开放。这是微软多模型路线的又一步,也意味着企业办公 AI 的模型选择权正在从单一供应商转向可替换的组件。

苹果计划今年秋季低调推出新一代 Apple TV,跳过发布会直接上线官网,核心变化是换上支持端侧大模型的新芯片,让 Siri 从机械搜索升级为能理解复杂自然语言的助手。

京东探索研究院在 9 月 9 日的 JDD 大会上发布了两项 JoyAI-Echo 系列新成果:JoyAI-Echo1.5 把连续音视频生成拉到 10 分钟以上,并开源了可交互视听世界模型 EchoWM。前者解决"生成得久",后者解决"能走进去、能操控",这也是世界模型从演示走向可用的一步。

月之暗面于2026年9月12日上线主力模型K2.8 Preview,已在Kimi Code和Kimi Work全量推送,官方称综合性能接近旗舰K3,编程与Agent能力提升明显,并支持1M超长上下文且向全部会员开放。