连续扩散语言模型 (CDLM’s)

在沉寂两三年之后,连续扩散语言模型(Continuous Diffusion Language Models)重新成为研究热点。相比当前主流的自回归大模型,这类模型试图用“去噪”而非“逐词预测”的方式生成文本,可能为可控生成、文本填充等任务开辟新路径。

在沉寂两三年之后,连续扩散语言模型(Continuous Diffusion Language Models)重新成为研究热点。相比当前主流的自回归大模型,这类模型试图用“去噪”而非“逐词预测”的方式生成文本,可能为可控生成、文本填充等任务开辟新路径。

MIT 的一份委员会报告指出,当前大模型已能对几乎全部本科书面作业给出可信解答,并在不到三年内实质改变了校园学习文化。与此同时,欧盟《AI 法案》正从另一个方向介入:用 AI 监控考试属于高风险行为,教育场景的情绪识别已被全面禁止。

Anthropic 对部分 Claude 用户执行强制登出、清除已保存支付方式并退款,原因是这些用户的 PC 感染了 infostealer 恶意软件,会话被劫持后账号额度被恶意消耗。这是 AI 服务商首次公开针对会话劫持型攻击采取大规模账号处置。

Academa 在 Hacker News 上展示了一套将 STEM 教学视频“代码化”的技术:用 LLM 生成可直接编辑、维护和翻译的“视频源代码”,并据此生成可交互的长篇教学视频,试图重构在线教育的生产链路。

Linux 基金会 IT 基础设施总监公开抱怨,AI 公司的爬虫正在对 git.kernel.org 发起海量抓取,消耗的 CPU 资源已超过所有合法访问的总和,迫使官方关闭部分功能来应对。

苹果硬件工程负责人 John Ternus 将于 9 月 1 日接替 Tim Cook 出任 CEO。他接手时面临组件成本上涨、AI 追赶压力与核心人才流失三大难题,苹果未来两年的产品节奏与技术路线将进入调整期。

OpenAI 宣布终止与 AI 编程工具 Cursor 的合作,原因是 Cursor 被 SpaceX 收购。根据提议,Cursor 对 OpenAI 模型的直接访问权限将于 2026 年 11 月 12 日结束,大量依赖该工具的开发者将面临迁移成本。

Academa 是一个利用大语言模型自动生成长篇 STEM 教学视频的新项目,目前在 Hacker News 上以“Show HN”形式公开。它尝试把 LLM 的内容生成能力从文本扩展到结构化、长时长的教育视频,值得关注的原因是它可能改变 STEM 教育内容的制作成本和分发方式。

一篇 Hacker News 热帖重新争论“为什么扩散模型没有在大语言模型中取代解码器架构”,核心观点是:让 ChatGPT 成功的不是生成方式,而是 RLHF 等后训练技术,扩散模型只是更复杂的 token 生成方式,并未解决真正的问题。

Google AI 发布 EnvHarness,一个可编程环境层,让原本固定不变的 Agent 训练环境变成可动态调整的自适应世界。这意味着 AI Agent 的训练方式正从“固定题库”走向“动态考场”,对提升复杂任务泛化能力有直接帮助。