人工智能能否回答 3 万亿美元的问题?

红杉资本合伙人David Cahn更新了AI基础设施投入的账本:到2026年,行业需产生3万亿美元收入才能收回所有芯片和数据中心投资。然而,当前头部AI公司的收入与这一目标差距巨大,而开源模型崛起和token价格下跌正在进一步动摇“烧钱-回报”逻辑。

红杉资本合伙人David Cahn更新了AI基础设施投入的账本:到2026年,行业需产生3万亿美元收入才能收回所有芯片和数据中心投资。然而,当前头部AI公司的收入与这一目标差距巨大,而开源模型崛起和token价格下跌正在进一步动摇“烧钱-回报”逻辑。

Google 正式发布 LiteRT.js,这是一个通过 WebAssembly 将端侧推理引擎 LiteRT 搬进浏览器的 JavaScript 绑定库,让开发者直接在网页中运行 .tflite 模型,实现接近原生性能的 AI 推理,同时保证用户隐私和零服务器成本。

OpenAI 正在测试一项名为“ChatGPT Sites”的新功能,让用户通过自然语言对话,直接将创意或描述转化为一个可公开发布的网站。这意味着,AI 生成网站的门槛从“会写代码”降至“会说话”。

AI通信与数据基础设施公司 Nixxy 宣布,董事会主席 David Kratochvil 于7月2日接任 CEO,同时资深企业家 Simon Kearney 于6月29日加入董事会。此举旨在通过“董事⻓兼 CEO”的集权架构加速战略执行,为公司下一阶段增长重组领导层。

Meta 发布了迄今为止在智能体和编程领域能力最强的 AI 模型 Muse Spark 1.1,并在性能上宣称超越谷歌 Gemini。同时,Meta 首次为旗舰模型设立付费 API,以激进定价进入商业市场,直接挑战 OpenAI 和 Anthropic。

地产经纪公司 Redfin 发布分析称,OpenAI 和 Anthropic 员工在 IPO 后持有的税后股权价值理论上足以买下旧金山都会区约 29% 的房屋。这一极端假设揭示了 AI 头部公司即将上市所催生的巨大个人财富,并已提前扰动当地楼市。

Anthropic 宣布从 7 月 12 日起,旗下最强消费级模型 Claude Fable 5(基于 Mythos 5 架构)将对现有订阅用户(月费 20、100、200 美元)额外按用量收费,费率与开发者 API 一致——每百万输入 Token 10 美元、每百万输出 Token 50 美元。这是主要 A…

NVIDIA 发布了一套基于 NeMo 框架的迭代式合成数据生成方案,用于解决金融大模型微调中真实数据稀缺、类别失衡的问题。该方案在 6 天内用单台 8 路 B200 节点生成了约 50 万条独特新闻标题,并开源了数据集,有望降低金融 NLP 研究的门槛。

用户在使用 Transformers v5(5+)版本的 Pipeline 对象进行推理或处理任务时,若输入是一个大型生成器(例如流式数据集、大文件逐行读取生成器),调用 pipeline 时会导致内存耗尽(OOM)。

用户在使用 Transformers 加载 MiniMaxAI/MiniMax-M3(428B 稀疏 MoE 视觉语言模型)时,配置了 4-bit 量化(nf4, double-quant)、 device_map="auto" 和 max_memory={i: "165GiB" for i in