SpaceXAI 推出 Grok Voice Transcribe 2.0:错误率砍半、价格纹丝不动,流式语音识别登顶榜单

SpaceXAI 于 9 月 18 日发布语音转文字模型 Grok Voice Transcribe 2.0,错误率较上一代降低约一半,价格保持不变,并在 Artificial Analysis 的 32 个流式模型榜单中排名第一。

SpaceXAI 于 9 月 18 日发布语音转文字模型 Grok Voice Transcribe 2.0,错误率较上一代降低约一半,价格保持不变,并在 Artificial Analysis 的 32 个流式模型榜单中排名第一。

MiniMax 把旗下命令行 AI 编程工具 Code CLI 的 v0.4.12 版本开源到 GitHub,公开了权限处理和调用逻辑。它在 FrontierHarness Eval 上取得 76.7% 任务成功率,成功任务耗时中位数 4 分 33 秒,两项指标均高于公开基线。

GPT-6 Astra 与三位人类研究者合作,在 FrontierMath 基准上解决了一道 2017 年起悬置的"重大突破"级开放问题——证明"核心"不可能为空,即绝对公平的委员会在任何情况下都存在。这是 AI 首次参与攻克该级别数学难题,Epoch AI 榜单已为此新增"Human + AI"标签。

DeepSeek 于 9 月 19 日补充说明 API 错峰计费规则,明确调休上班的周末与法定节假日一律按低谷价计费。这意味着从 9 月 20 日到 10 月 10 日将出现超过十天的"半价窗口",对高频调用 API 的开发者和团队来说是一次实打实的成本下降。

OpenAI 正式推出 Word 版 ChatGPT 插件,全球所有账户计划均可使用,免费用户也能直接体验。这意味着 Microsoft Copilot、Anthropic Claude for Word 和 OpenAI ChatGPT for Word 三套 AI 助手同时出现在同一个 Word 窗口里…

B站上线"AI 无限竞技场"测评榜,把上百个大模型的真实实测结果汇到一个公开榜单里,首轮由 GPT-6 Astra 居首。它值得关注的地方在于:评测权不再只握在少数机构手里,创作者的实际工作流成了排名依据。

B 站上线"AI 无限竞技场"大模型评测榜单,由不同分区 UP 主用真实工作流出题实测,首轮结果中 GPT-6 Astra 暂居第一,前五名有三款国产模型。它值得关注的地方在于:评测标准不再由厂商或固定跑分定义,而是由真实使用场景决定。

据路透社报道,Anthropic 正考虑在 IPO 筹备期间推出新模型,以应对 OpenAI GPT-6Astra 在企业市场带来的竞争压力,但新模型的安全评估尚未完成,发布时间未定。

据《华尔街日报》9 月 19 日报道,Claude 开发商 Anthropic 计划将 IPO 推迟到 11 月,目标估值约 2 万亿美元、募资最高 100 亿美元,均意在挑战 SpaceX 今年 6 月创下的纪录。

Hacker News 上一条讨论指出,企业若连自身数据的含义都梳理不清,再强的 AI 也无法带来有效决策。讨论的核心不是模型能力,而是数据上下文缺失这一更基础的问题。