一句话看懂:x.ai 发布 Grok 4.7,主打编程与知识工作场景,官方称在价格和速度不变的前提下提升了长任务处理、自我校验和安全防护能力,输入每百万 token 2 美元起、输出 6 美元起。
事件核心:发生了什么
x.ai 正式上线 Grok 4.7,定位是其面向编程和知识工作的最强模型。相比 Grok 4.6,它换用了规模更大的基础模型,并进行了更长时间、更难任务组合的强化学习训练,训练任务偏向需要数小时才能完成的长程问题。官方称该模型更擅长验证自己的输出、管理更长上下文,并原生理解 Grok 自家的运行框架,在对话和通用知识工作上表现更好。
在文档与演示文稿生成方面,Grok 4.7 在 GDPval 和 AA Briefcase 两个面向律师、护士、金融分析师等职业任务的基准上均优于 Grok 4.6。安全侧,它搭载了全新的防护栈,在 LatchBio 生物安全基准上达到 62.4%,在 HackerBench v0.3 上仅放行 3.3% 的高风险双用途提示。目前该模型已上线 Cursor 和 Grok Build,并可通过 Grok API、第三方编程工具链及云平台调用。定价为输入每百万 token 2 美元起、输出每百万 token 6 美元起,另提供输出速度翻倍、价格翻倍的快速版本。
为什么重要
这次更新的关键不在参数规模,而在训练配方和产品定位:把强化学习重心压到“长任务”和“自我检查”上,直接对准编程和知识工作这两块付费意愿最强的市场。价格与 Grok 4.6 持平甚至更低,说明 x.ai 在推理成本控制上有所积累,对同类前沿模型构成直接的价格压力。同时,新增的安全防护栈和针对网络安全、生物领域的双向能力,回应了监管和企业在高风险场景采用大模型时的核心顾虑。此外,向部分网络安全伙伴开放红队能力,显示 x.ai 正尝试把安全能力本身做成生态接口,而不仅是合规成本。
对用户/开发者/创作者的影响
对开发者而言,Grok 4.7 最实际的吸引力是价格和长上下文表现:如果 CursorBench 4.0 上的性价比结论可复现,它有望成为长时间运行的代码任务中替代现有模型的一个选项,API 接入方式与第三方工具链支持也降低了迁移成本。对普通用户和知识工作者,文档、演示文稿生成能力的提升意味着更接近可直接使用的产出,而不只是草稿。对创作者,Grok Both 运行框架的原生理解可能改善多轮对话和素材整理体验。需要注意,上述基准多为官方公布,实际表现仍需第三方验证。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 CursorBench 4.0 和 LatchBio、HackerBench 等基准的成绩能否被独立复现;二是第三方编程工具链和云平台的实际接入范围与延迟表现;三是竞品是否在相近价位跟进长任务与自我校验能力,这可能决定 2025 年下半年编程类模型的定价走向。
来源:x.ai


