SpaceXAI的Grok 4.6在“人工智能分析指数”中获得61分

SpaceXAI 发布 Grok 4.6,在 Artificial Analysis 智能指数上拿到 61 分,追平 GPT-5.6 Sol,并凭借低价和突出的智能体任务表现重回第一梯队。

SpaceXAI 发布 Grok 4.6,在 Artificial Analysis 智能指数上拿到 61 分,追平 GPT-5.6 Sol,并凭借低价和突出的智能体任务表现重回第一梯队。

白宫正在酝酿扩大其AI安全框架的覆盖范围,未来几个月可能把开源大模型也纳入发布前测试,而目前这一框架仅针对Anthropic、OpenAI等公司的闭源前沿模型。这意味着美国AI监管思路正从“一次成型”转向“动态跟进”。

Anthropic 发布了 Claude Code 的 v2.1.229 版本,但截至撰文时原始发布说明页面暂时无法访问。作为终端 AI 编程工具的持续迭代,该版本大概率集中于功能优化与稳定性改进,具体更新内容有待官方页面恢复后确认。

Anthropic 将 Chrome 侧边栏中的 Claude 升级为统一的 Claude Cowork 会话,任务可在浏览器、桌面、网页和移动端之间无缝续接,Max 和 Team 套餐今日可用。

AI 编程工具 Devin 的开发公司 Cognition 正洽谈新一轮融资,估值可能从 5 月的 260 亿美元跳升至至少 400 亿美元,背后是 AI 编程赛道商业化的快速放量。

SpaceXAI 发布 Grok 4.6,综合评测得分追平 OpenAI 最强模型 GPT-5.6 Sol,但 API 定价低出 60% 以上,直接加剧了大模型头部阵营的价格竞争。

Time 联合广告科技公司 Mobian 测试一种专供 AI 爬虫读取的“Agent Ads”,希望品牌信息能被 ChatGPT 等大模型引用;但 AI 搜索公司 Perplexity 明确反对,称这类做法是变相“cloaking”,并警告会对相关网站降权。

OpenAI 持股的 Thrive Holdings 以 120 亿美元估值完成 20 亿美元融资,这家“AI 私募股权”公司正通过收购传统企业并把 AI 植入其工作流,成为 AI 企业级落地的一种新样板。

三家独立数据源显示,Google Gemini 的市场份额正在被 ChatGPT 和 Claude 蚕食,其中 Pangram 统计的模型市场份额从 12% 跌至 1.9%——这种下滑趋势可能解释了近期 Google DeepMind 出现高层人事变动的原因。

法律科技创业者Robert Mahari加入Anthropic,负责推动Claude在法律业务场景的落地。这是Claude从通用对话工具向行业专业应用延伸的信号,也意味着