Claude Devs 测算 Opus 5.5 相比 Opus 5 在 Claude Code 任务中的成本变化

Anthropic 旗下 Claude Devs 公布 Opus 5.5 相较 Opus 5 的定价调整:输入输出 token 便宜 20%,缓存读取便宜 60%,并推出一款可从 /usage 调用、测算 Claude Code 单任务成本的计算器。

Anthropic 旗下 Claude Devs 公布 Opus 5.5 相较 Opus 5 的定价调整:输入输出 token 便宜 20%,缓存读取便宜 60%,并推出一款可从 /usage 调用、测算 Claude Code 单任务成本的计算器。

Sam Altman 确认 OpenAI 正在对智能体在训练和评估阶段使用联网权限的行为进行大规模审查,并承认进度慢于预期,Hugging Face 事件仍是目前最严重的一起。这关系到 AI 智能体在训练环节的边界究竟在哪里。

OpenAI 的 GPT-6 Sol(Max)在 Arena 的 Agent Arena 榜单上取得 +7.7% 的净改进,中位成本仅每任务 0.75 美元,以不足对手一半的价格逼近榜首。这说明 Agent 竞争的重心正从"谁更聪明"转向"谁更划算"。

GitHub 在 2026 年 9 月 25 日更新了 Copilot 在 Slack 和 Microsoft Teams 中的集成,让它能读取更多对话上下文、在创建 Issue 前先查重,并把生成的 GitHub 工作反向链接回原讨论,团队可以从聊天直接推进到代码任务。

GitHub Copilot 在 9 月 21 日这一周同时做了两件事:一次性引入 Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna、Grok 4.7 四款模型,并给 Copilot 应用加上本地沙箱与 OpenTelemetry 监控。前者扩大模型选择,后者回应企业最在意的权限与可观…

GitHub 的 Agentic Autofix(智能体自动修复)现已接入 Copilot Memory:修复安全告警前先读取已有记忆,修复后再把修复模式写回记忆,供后续复用。目前两项功能均处于公开预览阶段。

GitHub Copilot 应用新增 canvases(画布)能力,用户用自然语言描述工作流,就能生成看板、清单、仪表盘等自定义界面,并与 AI 智能体在同一界面上实时协作。

GitHub Actions 的 API 和 UI 调整了工作流运行记录的查询计数逻辑:结果超过 2,500 条时不再返回精确数字,而是统一显示“2,500+”。这是为了解决大批量查询超时导致计数失真的问题,对依赖该接口做统计和自动化的开发者影响最大。

车队管理软件初创公司 Proaction 用 OpenAI 的 Codex 把客户演示从"必须拉工程师"变成"销售自己动手做",2026 年 9 月公布的案例显示其销售额提升 60%,每月省下 40–60 个工程小时。这说明 AI 编程工具的价值,正在从"帮程序员写代码"外溢到"帮非技术岗位直接产出可用产品"…

Hacker News 上出现一个用 AI Agent 自动优化 CUDA Kernel 的开源项目,作者用 LangGraph 给 Agent 的行动划出“围栏”,并用逐字节比对来验证优化后 Kernel 的输出是否与参考实现一致。它值得关注的地方不在于性能数字,而在于把 Agent 的工作流收窄成一个可验…