我构建了一个自我改进的人工智能,你也可以吗

《Wired》杂志作者通过Claude和AutoResearch等开源工具,成功训练了一个能自动改进的小型语言模型,证明自改进AI不仅属于大型实验室,个人开发者也能实现,但需要强大的硬件支持。

《Wired》杂志作者通过Claude和AutoResearch等开源工具,成功训练了一个能自动改进的小型语言模型,证明自改进AI不仅属于大型实验室,个人开发者也能实现,但需要强大的硬件支持。

SpaceXAI 在 7 月 8 日发布了 Grok 4.5,这是其上市后推出的首个模型。CEO Elon Musk 将其对标 Anthropic 的 Opus 系列,并强调其在高性能的同时具备更快的速度和更低的成本。同日 OpenAI 也宣布将于次日发布 GPT 5.6,两家公司的正面竞争态势更加明朗。

谷歌的SynthID深度伪造检测系统成功识破了一张AI生成的美国参议员麦康奈尔住院窘境假图。这张图片在Reddit和X上广泛传播,但最终被权威事实核查网站Snopes通过SynthID水印技术证伪,这是该反伪造系统一次罕见且重要的实际应用胜利。

一起针对 xAI 的集体诉讼披露,一名男子使用 Grok 将 11 岁继女的照片生成了约 7000 张涉嫌儿童性虐待的 AI 图像,并在被捕保释后自杀。诉讼指控 xAI 在生成过程中仅对“轮奸”提示词生成了一场警报,且后续拒不配合执法机构提供用户 IP 等关键信息,涉嫌包庇犯罪者。

OpenAI 对前沿代码评测基准 SWE-Bench Pro 进行详细审计后,发现约 30% 的任务存在缺陷,包括测试过严、提示不完整等问题。这意味着当前基于该基准报告的模型代码能力分数可能存在水分,开发者与研究者依赖的评测信号需要重新审视。

OpenAI 于 2026 年 7 月 8 日发布了一套正式的《国家安全原则》,明确其 AI 技术在政府及国防合作中的使用边界,并披露了与多国政府开展的网络安全与生物安全合作进展。这是头部 AI 公司首次系统化、透明化地回应“AI 如何用于国家安全”这一敏感议题。

GitHub 在 2026 年 6 月至 7 月初发布的 VS Code 更新中,将 Copilot 从代码补全工具推向了更自主的“代理式开发”平台,引入了并行会话、成本追踪、模型市场发现和更智能的浏览器集成,显著改变了开发者与 AI 协作的方式。

由贝佐斯支持的纽约初创公司 General Intuition 刚刚完成 3.2 亿美元融资,估值达到 23 亿美元。该公司认为,大型语言模型(如 ChatGPT)无法真正理解物理世界中的时空运动,而游戏数据训练的世界模型可能才是实现通用人工智能(AGI)的关键突破。

大语言模型擅长处理文字,但在理解物理世界如何随时间与空间变化方面存在短板。贝佐斯支持的公司 General Intuition 正押注游戏数据,试图用“世界模型”弥补这一差距,其最新融资已达 3.2 亿美元。

OpenAI 于 2026 年 7 月 8 日发布 GPT-Live 系列全双工语音模型,专注低延迟实时对话,而将复杂推理任务转发给尚未公开的 GPT-5.5 处理,标志着语音交互从“问答型”向“任务分工型”转变。