资料来源:Cursor 正在构建一款代号为 Sand 的通用人工智能代理,面向非开发人员,可处理电子邮件、文本和文档,与 Claude Cowork 竞争(Grace Kay/The Information)

知名 AI 代码编辑器 Cursor 正在开发一款名为“Sand”的通用 AI 代理产品,目标用户从开发者扩展到非技术人员,直接与 Anthropic 的 Claude Cowork 在企业办公市场展开竞争。

知名 AI 代码编辑器 Cursor 正在开发一款名为“Sand”的通用 AI 代理产品,目标用户从开发者扩展到非技术人员,直接与 Anthropic 的 Claude Cowork 在企业办公市场展开竞争。

据彭博社报道,在企业客户收紧 AI 预算审查的背景下,OpenAI、Meta 和 SpaceXAI 正在调整策略,通过突出成本效率与性价比来向 Anthropic 等竞争对手施压,这标志着 AI 商业化竞争从“性能比拼”转向“ROI 说服”阶段。

有团队在生产中从旧版 GPT 模型迁移到 GPT-5.6,实测显示代理任务完成时间缩短一半以上(提速约 2.2 倍),同时成本降低 27%,且完成质量不低于原有方案。这一结果直接挑战了当前 AI 代理部署中的成本-效率权衡。

Anthropic 宣布将于 7 月 19 日向所有付费用户开放其最新的 Claude Fable 5 模型,同时将开发者工具 Claude Code 的每周使用上限提升 50%。这是该模型自发布以来最大规模的一次权限放宽,旨在加速企业级客户和开发者的采用。

AI领域权威学者、强化学习奠基人之一Rich Sutton在2024年7月发文指出,人工智能研究中普遍存在一种“一步陷阱”——过度依赖仅用单步预测的世界模型,通过迭代来推导长期结果。这种看似合理的做法,在现实中往往因误差累积和计算爆炸而失效,对当前大模型和推理系统的设计仍有重要警示意义。

Hacker News 上的热议指出,AI 模型推理成本正在快速下降,独立服务商已经在 OpenRouter 等平台上以远低于前沿实验室的价格提供接近顶尖水平的模型服务,因此未来模型价格不会因大厂提价而上涨,反而会持续走低。

一项针对编码 AI 助手的实测对比显示,Anthropic 的 Claude Code 在执行相同任务前,向 API 发送了 33k 令牌的系统提示与上下文数据,而开源替代 OpenCode 仅需 7k 令牌。这一差距暴露了闭源商业化产品在“Token 通货膨胀”和缓存策略上的效率问题。

独立技术评测机构 systima.ai 通过实测发现,Anthropic 的 Claude Code 在接收用户指令之前,会预先发送约 33,000 个系统提示和工具定义代币,而开源替代品 OpenCode 仅发送约 7,000 个。这导致 Claude Code 的每次请求基础成本高出近 5 倍,且缓存效率…

OpenAI 的编程辅助工具 Codex 暂时移除了 Plus、Business 和 Pro 用户的5小时使用限制,同时开始全面推送 GPT 5.6 Sol 模型的效率改进,使整体 token 消耗更低。这是 OpenAI 在提升产品体验与控制算力成本之间的一次重要平衡调整。
![[问与答] 你们使用大模型的输入输出比是多少?](https://www.chat-gpts.plus/wp-content/uploads/2026/07/ai_cover_5-397-768x403.jpg)
V2EX 上一位用户分享个人统计结果:大模型使用中,输入 Token 被实际利用的命中率高达 90-95%,而输出 Token 量仅占输入的 2-3%。这个极端的比例揭示了多数 AI 对话场景中,用户更依赖于向模型提供大量上下文,而模型只需给出简短回答的典型模式。