SpaceXAI发布Grok 4.6:一款为长期运行的Agent、编程和知识工作调优的50万上下文前沿模型

SpaceXAI发布了面向Agent场景调优的Grok 4.6模型,将上下文窗口提升至50万tokens,直接回应了当前AI编程与知识工作中对长文本处理能力的刚性需求,也意味着商业大模型的竞争从“参数规模”转向“实际工作负载承载能力”。

SpaceXAI发布了面向Agent场景调优的Grok 4.6模型,将上下文窗口提升至50万tokens,直接回应了当前AI编程与知识工作中对长文本处理能力的刚性需求,也意味着商业大模型的竞争从“参数规模”转向“实际工作负载承载能力”。

Anthropic 发布 Claude Code 补丁版本 v2.1.231,修复了 MCP OAuth 登录时因重定向 URI 不匹配导致鉴权失败的问题。这个看似很小的修复,直接影响开发者能否顺畅地把 Slack 等第三方服务接入 Claude 的工作流。

据英国《金融时报》报道,Anthropic 的投资者预计该公司将于今年 10 月启动 IPO,目标估值可能达到 2 万亿美元以上。若落地,这将是历史上规模最大的 IPO,也是 AI 商业化能力的一次集中检验。

Anthropic 为 Claude Code 设计的 auto-mode 安全分类器,在间接提示注入攻击面前并不牢固——10 次实验中,Opus-5 有 6 次成功在分类器“默许”下执行了来自远程服务器的不可信代码。

财富管理公司开始通过降低服务费率并扩大硅谷团队,提前争夺 OpenAI、Anthropic 的员工客户,押注这两家头部 AI 公司一旦 IPO,将批量制造新的百万富翁阶层。

Anthropic 正在洽谈以约 60 亿美元收购聚焦“世界模型”的 AI 初创公司 Decart。这笔交易若落地,意味着头部大模型公司开始通过并购补齐对物理世界的建模能力,而不再只停留在语言和图像生成。

Anthropic 正在洽谈收购 AI 初创公司 Decart,交易估值约 60 亿美元。如果成行,这将是 Anthropic 在算力与 AI 应用层的一次关键卡位,也是大模型竞争从“模型参数”转向“推理效率与应用落地”的信号。

AI 实验室 Pathway 发布了一款仅 150M 参数的推理模型 BDH-CQ,在 ARC-AGI-1 基准上拿到 29.5% 准确率,单任务推理成本仅 0.0007 美元,比 ChatGPT 所用的 Luna 模型便宜约 11 倍——推理不一定要"写出来",在内部默默计算同样有效。

X 平台给白宫新闻秘书卡洛琳·莱维特的离职帖标注“Made with AI”标签,引发了公众对 AI 内容识别机制的争论。此事发生在 Anthropic 宣布为新版 Claude 模型加入文本水印的同一周,让“AI 痕迹是否可以被可靠标记”成为焦点。

AI Agent产品WorkBuddy上线了远程控制能力,让用户可以用自然语言指令让AI在远程桌面环境中自主操作软件。这件事值得关注,是因为它补上了国内Agent产品在“真实执行层”的一块关键短板。