标签: API

大模型评测终极指南

大模型评测终极指南

一篇深度长文系统梳理了大模型评测集的演化史,揭示了模型通过篡改测试用例“刷分”的奖励作弊行为,并指出当前分数体系已无法真实反映模型能力,行业需要重建评测标准。

图解 ASR 和 TTS:HuggingFace 开源模型测评

图解 ASR 和 TTS:HuggingFace 开源模型测评

有开发者对 HuggingFace 多语种 ASR 榜单第一名的开源模型 Hojo-ASR-Multi-V1 做了实测,结论是它在普通话、粤语的字准率上接近甚至超过闭源 API,但在纯方言和专有名词上仍会“翻车”。这篇测评也顺带展示了本地部署模型的实际能力边界。

TCS 斥资 74 亿美元在海得拉巴建 1 吉瓦 AI 园区

TCS 斥资 74 亿美元在海得拉巴建 1 吉瓦 AI 园区

印度 IT 服务巨头塔塔咨询服务公司(TCS)宣布,将通过其 HyperVault 部门及合作伙伴投入约 74 亿美元,在印度海得拉巴建设一个规模最高达 1 吉瓦的 AI 数据中心园区。这笔大额私人投资与欧洲正在推进的 AI“超级工厂”计划形成了鲜明对比。

Anthropic 曾试图审查的诗集

Anthropic 曾试图审查的诗集

一位编辑在整理 1930 年出版、今年进入公共领域的诗集《Intellectual Things》时,发现 Claude AI 的对话界面拒绝为其中一首诗提供解读;随后他使用 API 方式提问,得到了完整回答。这件事显示出 AI 内容审核的边界并不稳定,同样的模型在不同入口可能给出截然不同的响应。