Agent Arena – 人工智能代理的首个公开舞台

NetMind 发布了 Agent Arena,一个让 AI 代理进行实时任务竞赛的开放平台,已吸引 7094 个代理注册,并提供超过 2.4 万积分的奖池和最高 10 万美元的真实奖励,为 AI 代理的能力评估提供了首个公开透明的竞技场。

NetMind 发布了 Agent Arena,一个让 AI 代理进行实时任务竞赛的开放平台,已吸引 7094 个代理注册,并提供超过 2.4 万积分的奖池和最高 10 万美元的真实奖励,为 AI 代理的能力评估提供了首个公开透明的竞技场。

美国政府拟限制Anthropic最新旗舰模型向海外用户提供API访问权限,此举可能削弱美国AI公司的全球竞争力,反而加速中国开源大模型生态的壮大。

彭博社最新分析指出,AI 投资热潮已从“遍地开花”进入“分化筛选”阶段,投资者和从业者需要从盲目追概念转向识别真正能落地、有护城河的公司与产品。

百度智能云千帆大模型平台于2025年6月25日(根据素材中“2026”应为原文笔误,实际事件时间为2025年)正式停止AI编程订阅产品“Coding Plan”的续费服务,并计划在2025年7月初推出按量计费的新产品“Token Plan个人版”。这意味着百度对AI代码助手产品从固定套餐模式转向更灵活的按量计…

微博在 2025 年 6 月 22 日发布官方命令行工具 weibo-cli,封装了其开放平台的 70 多个 API 接口,并原生支持 AI Agent 的 MCP 协议,使开发者和 AI 应用可以在终端内直接完成内容发布、数据检索和营销管理,将微博的社交数据能力开放给 AI 驱动的自动化工作流。

上线六年的占星 App Moonly 放弃“算命”式模板交互,在 2024 年底转向 AI 原生陪伴路线——利用大语言模型和用户长期上下文,试图把占星从“一次解答”变成“持续成长关系”。这一转型折射出 AI+灵性消费品类正在从流量生意转向用户留存竞争。

OpenAI原计划发布的旗舰模型GPT-5.6被要求“错峰”上线,目前仅对少数合作伙伴开放,且每个客户都需要逐一审批访问权限。这标志着大模型发布从“抢快节奏”转向“审核排队模式”。

微软在 Build 2026 上推出 Scout,一款基于开源框架 OpenClaw、拥有独立 Entra 身份的常驻型智能体,能从被动问答转向持续自主执行任务——这是微软从“Copilot”到“Autopilot”战略的关键一步。

法国AI初创公司Mistral AI于6月23日推出专为文档识别设计的OCR 4模型,支持170种语言,在OmniDocBench测试中得分93.07,其输出质量在人类评估中优于GPT 5.5 Pro和Gemini 3.1 Pro Preview。该模型不以参数量见长,而是专注于高精度文本识别、边框定位和区域…

法国AI公司Mistral AI于近期发布了文档识别模型OCR4,支持170种语言,在多项测试中表现优于GPT-5.5 Pro等竞品,并以较低价格提供API服务,为企业和开发者处理多语言文档提供了新的工具选择。