连续扩散语言模型 (CDLM’s)

在沉寂两三年之后,连续扩散语言模型(Continuous Diffusion Language Models)重新成为研究热点。相比当前主流的自回归大模型,这类模型试图用“去噪”而非“逐词预测”的方式生成文本,可能为可控生成、文本填充等任务开辟新路径。

在沉寂两三年之后,连续扩散语言模型(Continuous Diffusion Language Models)重新成为研究热点。相比当前主流的自回归大模型,这类模型试图用“去噪”而非“逐词预测”的方式生成文本,可能为可控生成、文本填充等任务开辟新路径。

Linux 基金会 IT 基础设施总监公开抱怨,AI 公司的爬虫正在对 git.kernel.org 发起海量抓取,消耗的 CPU 资源已超过所有合法访问的总和,迫使官方关闭部分功能来应对。

Academa 是一个利用大语言模型自动生成长篇 STEM 教学视频的新项目,目前在 Hacker News 上以“Show HN”形式公开。它尝试把 LLM 的内容生成能力从文本扩展到结构化、长时长的教育视频,值得关注的原因是它可能改变 STEM 教育内容的制作成本和分发方式。

一篇 Hacker News 热帖重新争论“为什么扩散模型没有在大语言模型中取代解码器架构”,核心观点是:让 ChatGPT 成功的不是生成方式,而是 RLHF 等后训练技术,扩散模型只是更复杂的 token 生成方式,并未解决真正的问题。

芯片设计初创公司 Agentrys 完成 2450 万美元两轮早期融资,由 MediaTek 和 Etna Labs 分别领投。这家公司瞄准的是 AI 算力需求爆发下的专用芯片设计赛道,值得关注的是其背后的联发科产业资本布局。

米哈游旗下桌面陪伴软件《BSide: Olivia Lin》在Steam抢先体验上线不足一个月后,于8月31日正式停运,官方同日限时提供离线版本下载。这款主打AI虚拟角色陪伴功能的产品快速关停,反映出当下AI陪伴类应用在商业化与运营持续性上的现实困境。

丹麦政府针对高中阶段日益严重的生成式 AI 作弊问题,推出紧急整治计划,核心是在笔试和作业基础上增加口头答辩,并在机考时监控学生电脑屏幕。此举意味着教育体系开始从“禁止使用”转向“有监督地使用”AI。

澳大利亚公平工作委员会(Fair Work Commission)公开谴责一份由 AI 生成的法律意见书“完全错误”,并指出该意见书在关键法律推理上存在严重缺陷。这一事件再次提醒所有行业:大模型输出的专业建议必须经过人工核验,不能直接用于正式决策。

当大模型参数规模逼近 7000 亿,普通消费级显卡的 8GB 显存早已无法直接加载推理,量化和蒸馏成为把模型“塞进去”并跑起来的关键技术手段。这篇文章梳理了这两条技术路线的原理和适用场景,帮助开发者理解如何在算力受限环境下部署大模型。

一条由 AI 生成视频并搭配 AI 编曲的短片在 X 平台获得 16.6 万次观看,被创作者称为“目前 AI 视频加编曲的天花板”,展示了多模态生成工具在内容创作端的整合成熟度。