一句话看懂:字节跳动正在训练参数量最高达10万亿的大模型,规模直接对标 Anthropic 顶级系统,若落地将成为中国最大模型,也意味着这家 TikTok 母公司正式加入全球最前沿的闭源大模型竞赛。
事件核心:发生了什么
据《金融时报》援引三位知情人士消息,字节跳动正在预训练一个参数规模最高达10万亿的 AI 模型。该规模是当前中国最大模型 Moonshot Kimi K3(约3万亿参数)的三倍,也与 Anthropic 旗舰系统 Mythos 5 处于同一量级——业内估计后者约为8万亿参数,但 Anthropic 未公开确认。模型目前处于预训练阶段,这一阶段通常持续三到六个月。值得注意的是,消息人士称字节跳动已有一年多避免使用“蒸馏”——即不依赖其他公司模型的输出来训练自家模型。创始人张一鸣已向约2000人的 Seed 团队明确要求,以长期视角追求世界领先的模型能力。
为什么重要
这一消息透露了几层关键信息:其一,字节跳动选择走超大参数密度的闭源路线,直接对标 Anthropic 和 xAI 而非开源生态,意味着其 AI 战略重心正从应用层(如豆包、即梦)向上游基础模型延伸;其二,放弃蒸馏训练方式,说明字节在数据积累和原始训练能力上的投入决心——不依赖他人模型输出,长远看更容易形成差异化能力;其三,10万亿参数规模的训练对算力、数据、工程能力都是极高考验,字节若完成训练,将把中国大模型的复杂度上限拉高一个量级,并直接改变国内头部模型公司的竞争参照系。
对用户/开发者/创作者的影响
目前公开信息显示,该模型尚处于早期预训练阶段,短期不会直接影响普通用户。但从方向上看,若字节将这一超大模型的能力通过豆包、扣子(Coze)或 API 形式对外输出,开发者和创作者可能获得更强的上下文理解、推理和生成能力,尤其在长文本处理、复杂任务拆解和高质量图像生成等场景。对依赖国产模型 API 的开发者而言,字节加码底层模型也意味着未来在选择供应商时多了一个“高上限”选项。不过需要留意的是,超大模型的推理成本通常较高,即便是字节这样的公司也需要在能力与单位成本之间找到平衡。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是训练落地时间:预训练通常需要三到六个月,后续还需对齐与调优,实际发布窗口可能在2027年上半年,是否按预期推进值得跟踪;二是“去蒸馏”策略的成效:在没有直接参照模型输出的情况下,字节能否在推理能力上追平甚至超越 Anthropic 和 xAI 的同类产品;三是行业连锁反应:如果字节的10万亿参数模型如期发布,百度、阿里、腾讯等厂商是否会加速更大规模模型的研发,以及监管层面如何回应中国最大模型的合规问题。


