Cognition 让 Devin 借助 GPT-6 Astra 测试自己的工作成果

2026 年 9 月 11 日,OpenAI 披露 Cognition 将 GPT-6 Astra 接入 Devin、CLI 和桌面产品,让 AI 自动测试自己写的代码并输出运行录像与测试报告。这意味着代码审查的形态可能从“人逐行看代码”转向“人看 AI 提供的验证证据”。

2026 年 9 月 11 日,OpenAI 披露 Cognition 将 GPT-6 Astra 接入 Devin、CLI 和桌面产品,让 AI 自动测试自己写的代码并输出运行录像与测试报告。这意味着代码审查的形态可能从“人逐行看代码”转向“人看 AI 提供的验证证据”。

Perplexity 已把 GPT‑6 Astra 接入到通信撰写、真实系统修改和生产环境监控等端到端流程中,并显著降低人工检查频率。这反映出大模型正从“辅助写代码”转向“独立托管系统”,对 AI 应用的信任边界提出了新问题。

一名用户让 Claude 生成一份"AI 能接管哪些人类工作"的清单,随后以"魔鬼代言人"的方式逐条反驳这些结论。这篇发在 Hacker News 上被广泛讨论的文章,价值不在于给出答案,而在于示范了如何不把大模型的输出当成结论。

《经济学人》报道称,一批顶尖数学家对 OpenAI 在数学研究中使用 AI 的方式公开表达不满,争议焦点集中在成果归属、研究伦理与 OpenAI 的沟通手法上。这关系到 AI 大模型进入基础科研后,学术共同体如何界定"谁做了研究"。

Anthropic 发布迄今最详细的安全威胁情报报告,披露并阻断了一批试图滥用 Claude 的行为;与此同时,中文社交平台上出现将其解读为“借刀杀人”的评论,认为这会加剧国内对 AI 数据出境与前沿实验室合规的担忧。

一段在抖音流传的教程声称,可用 GPT-6 Astra 调用 Blender 生成白模,再结合 Seedance 2.5 控制复杂运镜与动作,减少 AI 视频反复抽卡。它值得关注的原因不是技术已被官方证实,而是它指向了 AI 视频创作的一条现实路线:用 3D 预演锁定镜头,再交给视频模型生成。

OpenAI 推出面向金融行业的专用版 ChatGPT,内置 Daloopa、PitchBook、LSEG News 等付费数据集,并联合摩根士丹利、Evercore 的投资专家参与开发。它值得关注的地方在于:OpenAI 正在从通用聊天工具转向"行业垂直 + 数据打包"的企业级产品路线。

一篇在 Hacker News 上热传的技术博客对当下流行的"Loop Transformer"思路提出质疑,作者认为简单套用同一组 Transformer 权重循环两次并不能解决下一代模型的核心问题,真正值得关注的是对 Context 做细粒度管理的递归式结构。

一位美国公立大学讲师总结2026年春季和夏季课堂上学生对 AI 的真实看法:他们几乎不觉得聊天机器人在近几年有实质进步,把 Claude Code 当成“本来就这么简单”的工具,而不是 AI 能力的证明。这提醒我们,技术圈感知的“飞速迭代”和普通用户的实际体感之间存在明显落差。

OpenAI 把 GPT-Live-1 开放到 API,这是一个把语音理解和语音输出合并到同一模型里的实时对话模型,支持全双工、可被打断,也能接电话做客服。它值得关注的地方在于:语音 AI 开始从“一问一答”的轮次式交互,转向更接近真人通话的连续对话,并且已经给出了明确的分钟级定价。