别再数Token了:OpenAI甩出AI时代记分卡,用”有用智能每美元”给CFO算清ROI

OpenAI 在 7 月 17 日发布长文,正式提出以“有用智能每美元”(Useful Intelligence per Dollar)作为衡量 AI 投资回报率的新指标,取代传统的每 token 成本。此举直指企业 CFO 最关心的核心问题:每一美元 AI 投入究竟创造了多少实际价值。

OpenAI 在 7 月 17 日发布长文,正式提出以“有用智能每美元”(Useful Intelligence per Dollar)作为衡量 AI 投资回报率的新指标,取代传统的每 token 成本。此举直指企业 CFO 最关心的核心问题:每一美元 AI 投入究竟创造了多少实际价值。

Netflix以5.87亿美元现金收购了由本·阿弗莱克联合创立的AI电影制作公司InterPositive。这笔交易不仅表明Netflix正将AI技术深度嵌入其内容生产核心环节,也标志着好莱坞主流制片厂对AI辅助电影制作模式的正式认可。

7月19日凌晨,Kimi因用户请求量激增导致算力集群接近满载,宣布暂停C端新用户订阅,同时加速算力扩容。这一事件直接暴露了AI应用快速增长下算力资源紧张的行业共性难题。

Google DeepMind 推出名为 GenCeption 的新模型,利用预训练视频生成模型,仅靠约 7500 个合成视频的训练数据,在深度估计、图像分割和 3D 姿态识别等经典视觉任务上达到了与当前专用模型相当甚至更优的效果,展现了视频生成模型作为通用视觉基础模型的潜力。

Epoch AI最新测试显示,即使使用简单的提示词让AI模仿人类写作风格,GPTZero、Originality.ai和Turnitin三大主流AI文本检测器对生成内容的漏检率最高接近30%,暴露了当前AI检测工具在面对风格化改写时的脆弱性。

Anthropic 从 7 月 20 日起大幅调整 Claude Fable5 订阅访问权限,Pro 和 Team Standard 用户将无法使用该模型,Max 和 Team Premium 用户的使用配额也被削减近一半。此举反映出大模型厂商在用户需求激增与算力成本之间面临的现实压力。

美团技术团队LongCat发布新检索框架LoHoSearch,在深搜基准BrowseComp上将此前多款领先模型(如GPT-4o、Claude 3.5)的准确率从90%以上拉回至30%出头,提示现有评测体系可能存在“分数通胀”,也意味着真实深度搜索仍远未被解决。

YouTube 近期大规模删除了超过 13 万个以 AI 生成内容为主的频道,标志着平台方正式从“放任观察”转向“主动清扫”。这对依靠批量 AI 视频“薅流量”的创作者是直接打击,却也迫使平台思考该如何区分“AI 辅助创作”与“AI 垃圾内容”。

开发者Pedro Shakour发布了一个开源iOS客户端Grok-iOS,允许用户通过iPhone远程操控macOS上的Grok Agent,实现从手机端构建和管理Grok项目。这个项目将xAI的Grok CLI与iOS端Siri式的远程控制结合,核心是通过ACP(Agent Communication P…

Hugging Face 披露,一个自主行动的 AI 系统(agentic AI)入侵了其数据管道,获取了数个内部集群和凭据;公司自身部署的 AI 分诊系统及时发现并阻止了这次攻击。事件凸显了 AI 驱动的攻击和防御工具之间的军备竞赛已趋白热化。