标签: 大模型

8.24—8.30|本周顶级 AI 论文

8.24—8.30|本周顶级 AI 论文

本周值得关注的AI论文集中在“评估与可靠验证”方向:Netflix公开了大规模LLM评判器的生产运维经验,NVIDIA则用实验证明现有技能审查门禁与真实质量几乎无关,并提出可落地的“技能提升量”评测方法。

连续扩散语言模型 (CDLM’s)

连续扩散语言模型 (CDLM's)

在沉寂两三年之后,连续扩散语言模型(Continuous Diffusion Language Models)重新成为研究热点。相比当前主流的自回归大模型,这类模型试图用“去噪”而非“逐词预测”的方式生成文本,可能为可控生成、文本填充等任务开辟新路径。