Arena 开放限时测试 Claude Sonnet 5.5,Direct Mode 可用 48 小时

Anthropic 的 Claude Sonnet 5.5 已在 Arena 的 Direct Mode 上限时开放 48 小时免费测试,截止到 10 月 2 日上午 8 点(太平洋时间)。这是继 Sonnet 5 之后 Claude 5.5 家族的第二款模型,官方称速度提升超 30%、成本降低最多 30%。

Anthropic 的 Claude Sonnet 5.5 已在 Arena 的 Direct Mode 上限时开放 48 小时免费测试,截止到 10 月 2 日上午 8 点(太平洋时间)。这是继 Sonnet 5 之后 Claude 5.5 家族的第二款模型,官方称速度提升超 30%、成本降低最多 30%。

美国联邦贸易委员会(FTC)正对 OpenAI、Anthropic 等头部 AI 实验室展开消费者保护调查,并计划用具有法律约束力的“民事调查令”强制交文件、问高管。这意味着大模型公司不只被问“安不安全”,还要回答“有没有误导用户、损害消费者”。

Hugging Face 在 2026 年 9 月 30 日发布 Open TTS Leaderboard,用客观指标评估多语言文本转语音与语音克隆模型,把单个模型的评测周期从数周缩短到数小时,试图补上开源 TTS 评测长期碎片化的短板。

OpenAI 与覆盖百万创业者的 America’s SBDC 合作,计划培训约 150 名小企业顾问,并通过线下工作坊触达至少 1000 家小企业;同期报告显示,单周约有 400 万名小企业员工在使用 OpenAI 工具。

Google DeepMind 发布 SynthID Bio,把水印从图像、文本扩展到合成生物学:在 AI 设计的蛋白质序列和 3D 结构里嵌入可验证签名,且在实验室测试中不影响蛋白质功能。它要解决的是 AI 生成生物设计难以溯源、可能绕过 DNA 合成筛查的问题。

OpenAI 在 ChatGPT 内上线了常驻型 AI Agent「Dots」,用户只需设定目标和边界,它就能在对话之外自主推进任务,并且每个 Dot 都运行在独立的云端电脑与浏览器里。目前只对 Pro 和 Business Premium 用户开放,且不额外收费。

贝恩咨询调查 1397 位营销与财务高管发现,95% 的营销组织已采用 AI 工具,但只有 6% 表示 AI 带来了显著业绩回报;不过少数高增长公司获得回报的概率是低增长公司的两倍,差距在于组织重构而非工具采购。

两位前 Google 高管为新基金 BAG Ventures 募到 1130 万美元,专门投早期 AI 创业公司。他们的判断是:企业已经过了"随便试试 AI"的阶段,只愿意为能算清账、真正干活的确定性产品付钱。

Android Police 撰稿人 Parth Shah 梳理了 Gemini 四个容易被忽略的用法:定时任务、跨应用调度、Notebooks 深度研究、以及 Gemini Live 实时整理,核心判断是 Gemini 正从"更聪明的搜索框"变成可执行多步操作的工作流中枢。

金融 Layer 1 公链 Pharos Network 在韩国区块链周发布 Agent Native 升级,让 AI agent 能在链上持有资产、调用工具、互相协作并自行付费,首批功能已上线测试网。