算力告急:谷歌限制 Gemini 模型调用,Meta 研发进度受阻

由于 Gemini API 调用量在一年内翻倍,谷歌于 2026 年 5 月 17 日起对模型调用实施配额限制。Meta 因需求量过大未能获得足额算力,多个内部 AI 项目进度受阻。这一事件暴露出 AI 算力基建的供给速度已跟不上大模型应用需求的爆发式增长。

由于 Gemini API 调用量在一年内翻倍,谷歌于 2026 年 5 月 17 日起对模型调用实施配额限制。Meta 因需求量过大未能获得足额算力,多个内部 AI 项目进度受阻。这一事件暴露出 AI 算力基建的供给速度已跟不上大模型应用需求的爆发式增长。

百度开源了一款名为Unlimited OCR的3B参数端到端OCR模型,在GitHub上5天内Star数破万。其通过一项新的注意力机制,实现了对长文档(如书籍、论文)的连续解析,并在权威基准测试中以93.92%的得分刷新纪录。

韩国政府宣布将推出按区域划分的差异化电价体系,并设立“AI数据中心专用电价方案”,旨在通过低成本的稳定电力供应,引导半导体工厂和AI数据中心向地方扩散,确保国家在AI时代的核心竞争地位。

新浪开源的 VibeThinker-3B 模型仅有 30 亿参数,但在数学、编程等高难度基准测试中表现持平甚至超越 GPT-5.2 等百倍规模的大模型。它通过多阶段后训练将大模型的逻辑推理能力压缩进小模型,可能改变对通用大模型“唯参数论”的依赖。

2026年6月29日,OceanBase发布以湖库一体为核心架构的AI数据库,旨在解决企业AI应用落地中“数据孤岛”与“业务上下文缺失”的关键瓶颈。该产品将数据湖、数据库交易分析能力、多模态数据处理统一在一个引擎内,帮助智能体(Agent)一次获取完整业务上下文,从而提升AI在企业场景中的实用价值。

一项针对 OpenAI Codex 接口的 Token 优化技巧在开发者社区中被验证有效,允许用户通过简单设置减少约 30% 的 Token 消耗,直接降低 API 调用成本,引发了对 AI 推理阶段效率优化的关注。

AI大模型正在从技术工具升级为组织管理工具,迫使企业打破传统的层级制、部门壁垒和“权力博弈”,转向以数据和算法驱动、更加扁平敏捷的协作模式。这不仅是效率提升,更可能重塑未来公司的权力结构。
![[酷工作] 北京,内推,小米,AI 基建架构师/研发效能工程师。组内直推,hc5+](https://www.chat-gpts.plus/wp-content/uploads/2026/06/ai_cover_1-1030-768x403.jpg)
小米正在北京急招AI基础设施方向的资深工程师,组内直推、多个HC,岗位覆盖沙箱安全、可观测体系和Agent架构,要求7年以上后端经验且至少2年AI基础设施背景。

高盛最新报告指出,地缘政治导致的石油价格极端波动风险正在下降,而 AI 领域的资本投入与估值分歧正成为驱动全球金融市场波动的新核心因素。对投资者和从业者而言,理解 AI 产业链的“泡沫”与“机会”之争,比关注油价更紧迫。

中国互联网三巨头阿里、腾讯、字节跳动正在加速布局 AI 大模型与落地应用,从底层模型到上层产品形成全面对抗,一场围绕算力、API 和用户场景的长期竞争已经拉开帷幕。