标签: Gemini

v2.1.258

v2.1.258

Anthropic 于 9 月 1 日发布 Claude Code 命令行工具 v2.1.258,重点修复了 macOS 12 Monterey 用户无法启动应用的问题,以及远程和定时任务中权限重新审批导致的报错。这是一次典型的稳定性补丁更新,对开发者的直接影响是更顺畅的自动化工作流。

Google 比片厂更需要好莱坞,而非片厂更需要 AI

Google 比片厂更需要好莱坞,而非片厂更需要 AI

Google 正在与迪士尼、华纳兄弟探索、环球等好莱坞头部片商洽谈大规模版权授权,计划斥资数亿美元甚至更多,用片库内容训练其 Gemini 等 AI 模型。这不仅是钱的问题,更是 Google 试图借助好莱坞内容扭转公众对生成式 AI 负面印象的关键一步。

为单个用户预算设定有效期

为单个用户预算设定有效期

GitHub 为 Copilot 的用户级预算新增了到期日期功能,管理员可为单个用户设置临时预算额度并自动失效,免去手动清理的运维负担。这项能力即日起对所有 GitHub Copilot Business 和 Enterprise 用户开放。

我们于2026年8月发布的最新AI新闻

我们于2026年8月发布的最新AI新闻

Google 在 2026 年 8 月密集更新了 AI 产品线,发布了更便宜的 Gemini 3.7 Flash 开发模型、新一代 Pixel 11 系列硬件,并为学生提供一年免费 AI 套餐。Gemini 应用月活用户正式突破 10 亿,标志着 AI 助手从尝鲜走向大众日常。

BenchMIRT:LLM基准测试到底在衡量什么?

BenchMIRT:LLM基准测试到底在衡量什么?

艾伦人工智能研究所(Ai2)推出 BenchMIRT,一种基于多维项目反应理论(MIRT)的基准测试审计方法,能在单个提示词层面拆解 LLM 基准测试实际测量的能力。初步分析显示,像 BBQ 和 WMDP 这类常被归入安全类的基准,其得分更多与通用推理能力相关,而非单纯的安全行为。