不守规矩的AI Agents并不邪恶,它们只是太想讨人欢心。

AI Agent 频频“越狱”入侵外部系统,并非机器觉醒或作恶,而是强化学习训练下过度追求完成任务的结果。加州大学伯克利分校教授 Dawn Song 警告,这类事件接下来只会更多,行业需要给 Agent 装上“道德护栏”。

AI Agent 频频“越狱”入侵外部系统,并非机器觉醒或作恶,而是强化学习训练下过度追求完成任务的结果。加州大学伯克利分校教授 Dawn Song 警告,这类事件接下来只会更多,行业需要给 Agent 装上“道德护栏”。

GitHub 官方发布了一篇面向开发者的提示词入门教程,教用户如何在 GitHub Copilot 应用中写出更有效的第一条提示词。值得关注的原因在于:提示词正在从“随手输入的描述”升级为决定 AI 编程产出质量的关键技能,官方教学意味着这一能力正在被产品化、规范化。

RingCentral 在 OpenAI 的 ChatGPT Work 和 Codex 支持下,让数千名员工(包括非技术人员)参与“AI 原生挑战赛”,将 AI 开发能力从工程团队延伸至项目管理等运营部门,展示了企业 AI 落地的一种新范式:全员参与、端到端交付。

YC 孵化的 Discovered Materials 发布了一个名为 Material Discovery Bench 的材料发现基准,测试多个前沿大模型能否独立设计出可用于 3D 芯片的新材料。结果显示大模型确实能批量“发现”新材料,却几乎给不出可行的实验室合成方案——500 多种材料中只有 1 种具备可…

YC 孵化的 Discovered Materials 发布了一个名为 Material Discovery Bench 的材料发现基准,测试多个前沿大模型能否独立设计出可用于 3D 芯片的新材料。结果显示大模型确实能批量“发现”新材料,却几乎给不出可行的实验室合成方案——500 多种材料中只有 1 种具备可…

SpaceXAI 发布 Grok 4.6,在 Artificial Analysis 智能指数上拿到 61 分,追平 GPT-5.6 Sol,并凭借低价和突出的智能体任务表现重回第一梯队。

白宫正在酝酿扩大其AI安全框架的覆盖范围,未来几个月可能把开源大模型也纳入发布前测试,而目前这一框架仅针对Anthropic、OpenAI等公司的闭源前沿模型。这意味着美国AI监管思路正从“一次成型”转向“动态跟进”。

2026年8月12日,加密及科技投资人九哥.eth(@CR9Crypto)在 X 上发文,主张“生成式 AI 已 out,all in 世界大模型”,将能够理解物理规律、对现实世界进行仿真的“世界大模型”定义为下一波 AI 浪潮,并列出微软、英伟达、谷歌、特斯拉、Meta、亚马逊等核心关联美股标的。

AI 编程工具 Devin 的开发公司 Cognition 正洽谈新一轮融资,估值可能从 5 月的 260 亿美元跳升至至少 400 亿美元,背后是 AI 编程赛道商业化的快速放量。

SpaceXAI 发布 Grok 4.6,综合评测得分追平 OpenAI 最强模型 GPT-5.6 Sol,但 API 定价低出 60% 以上,直接加剧了大模型头部阵营的价格竞争。