Claude Code v2.1.197 发布:默认模型升级为 Claude Sonnet 5,支持原生 1M-token 上下文窗口

Anthropic 于 6 月 30 日发布 Claude Code v2.1.197,将默认模型升级为 Claude Sonnet 5,首次在终端内提供原生 100 万 token 上下文窗口,并推出每百万 token 输入 2 美元、输出 10 美元的限时促销价。

Anthropic 于 6 月 30 日发布 Claude Code v2.1.197,将默认模型升级为 Claude Sonnet 5,首次在终端内提供原生 100 万 token 上下文窗口,并推出每百万 token 输入 2 美元、输出 10 美元的限时促销价。

GitHub 与 JetBrains 宣布升级 AI 集成,Copilot Agent 被直接嵌入 JetBrains AI Assistant 的 Agent 选择器中,开发者可以在 IDE 内部直接选择 Copilot 模型处理多步骤编码任务,并切换推理深度。这是 Copilot 从辅助补全向独立编码代理…

GitHub 在 Release 页面新增了侧边栏导航,并直接显示每个发布资产的下载次数,此前仅通过 API 可查。这一变化让版本管理和资产热度评估更直观。

一个代号“MopMonk(扫地僧)”的匿名AI系统,以73.1%的成功率闯入网络安全基准测试CyberGym全球第七,在中国团队中排名第一,成绩紧咬OpenAI。其身份至今未公开,但基座模型来自上海AI公司MiniMax的M3模型,技术报告显示这是一套专为漏洞挖掘设计的Agent框架。

X 于本周一推出官方托管的 MCP 服务器,允许 Claude、Cursor、Grok Build 等 AI 助手直接通过用户授权连接平台。此举去掉了开发者自行搭建集成基础设施的环节,让 X 从社交平台转向可被 AI 实时调用的信息网络。

OpenAI 工程师在排查 ChatGPT 数据基础设施偶发崩溃时,发现两个极难复现的 bug:一个是 18 年前 GNU libunwind 库中的竞态条件,另一个是 Azure 宿主机的硬件静默损坏。团队采用类似流行病学的人口级数据分析方法,才从数百万次执行中定位出这两个“不可能”的错误。

GitHub 宣布自 2026 年 8 月 25 日起,对 Dependabot 安全警报实施数据保留策略,关闭超过 2 年的警报将自动归档、不再通过 UI 或 API 直接查询,但可下载 CSV 存档。这是 GitHub 安全数据生命周期管理的正式化,开发者与企业应提前规划历史警报的查询与合规策略。

用户在使用 LiteLLM 代理时,客户端发送了 tools: [{ "type": "code_interpreter", "container": { "type": "auto" } }] 请求。默认情况下,代码会在 OpenAI 管理的容器中执行。管理员希望将代码执行重定向到自己的基础设施(
![[Bug]: Heavy RAM Usage over time](https://www.chat-gpts.plus/wp-content/uploads/2026/07/12685-b90db227-768x403.jpg)
用户通过 Docker 部署 LiteLLM Proxy,每天发起大量请求(含 proxy 和 pass-through 模式),运行数天后 RAM 持续增长,直至触发监控警报或容器因内存耗尽被重启。部分用户反映在空闲状态下内存也会逐步膨胀,单容器可消耗 14–20 GB 内存。

2026年6月29日,帕兰蒂尔宣布与英伟达联合启动一项计划,帮助美国政府部门和关键基础设施在安全、自主可控的环境中部署英伟达的Nemotron开源模型。这次合作的重点不是发布新模型,而是为高度机密的AI工作负载搭建一套可审计、可定制的运行架构。