因编码能力未达内部目标,Google下一代Gemini Pro进度落后数月

据 Bloomberg 报道,Google 下一代 Gemini Pro 大模型因编程能力未达内部指标,进度已落后数月,原定在 5 月开发者大会发布的计划可能推迟。这一延误正加速资深工程师流向 Anthropic 和 OpenAI,进一步拉大 Google 与竞争对手在代码生成领域的差距。

据 Bloomberg 报道,Google 下一代 Gemini Pro 大模型因编程能力未达内部指标,进度已落后数月,原定在 5 月开发者大会发布的计划可能推迟。这一延误正加速资深工程师流向 Anthropic 和 OpenAI,进一步拉大 Google 与竞争对手在代码生成领域的差距。

标准普尔于7月9日将Oracle信用评级下调至BBB-,距垃圾级仅一步之遥。原因是其斥资2500亿美元建设AI数据中心的计划导致自由现金流大幅恶化,债券市场已提前按垃圾债定价其10年期债券。

1Password 上线 Claude 集成,AI 智能体可替用户登录网站,但密码和一次性验证码对 Claude 全程不可见。这一设计将 AI 调用凭证与密码直接泄露隔离开来,为 AI 自动化操作的企业安全落地提供了新范式,同时也带来新的账户风险边界问题。

开发者构建了一个自主智能体测试框架,让Claude Fable 5和GPT-5.6 Sol在100美元和25美元预算下,自动完成从研究、生成到剪辑的全流程音乐视频制作。结果不仅展示了两个模型在工具调用和预算分配上的策略差异,还暴露了当前AI自主创作的成本结构和效率瓶颈。

知名风投 Founders Fund 宣布聘请前 OpenAI 产品政策副总裁 Ryan Beiermeister 出任合伙人。她的履历中包括在 OpenAI 因反对“成人模式”而被解雇的争议事件,以及在一档 YouTube 节目中与多位硅谷大佬玩“黑手党”游戏表现出的策略能力,但基金方明确表示,招聘并非因为…

月之暗面于2025年7月发布的Kimi K3模型,在人工智能分析平台Artificial Analysis的智能指数中排名全球第四,表现突出,但输出速度低于平均、价格偏贵,且生成内容极为冗长。这标志着国产闭源模型在顶级智能水平上已具备竞争力,但在商业化性价比上仍有挑战。

Moonshot AI 的最新模型 Kimi-K3 在 Frontend Code Arena 编程测试中登顶,超越了 Anthropic 的 Claude Fable 5,并在 Terminal Bench 2.1 测试中仅以 0.5 分之差落后于 OpenAI 的 GPT-5.6 Sol。这标志着国产大模…

LM Studio 于近日发布了一款独立的 AI 智能体产品“Bionic”,专门面向开源模型运行。它允许用户在本地或云端使用开源模型完成编程、文档处理和研究等复杂任务,并承诺用户数据零留存。这一动作让开源模型在实用化、竞争闭源产品方面迈出了关键一步。

谷歌为AI模式(AI Mode)新增了Canva、Instacart和YouTube Music三项第三方应用集成,用户现在可以直接在搜索界面中完成购物、创建播放列表、设计海报等实际任务,而不只是获取搜索结果。

纽约时报 记者Kashmir Hill在亚马逊平台上发现多本由AI生成的、未经授权的个人传记,其中也包括她自己和其他记者的假传记。这些书籍的作者身份模糊、无法联系,揭示了AI生成内容在电商平台上大规模涌现且缺乏监管的现实。