Google的DiffusionGemma证明,构建文本扩散模型无需从头训练。

Google DeepMind 将现成的 Gemma 4 模型改装成文本扩散模型 DiffusionGemma,只用不到 10% 的训练数据预算,换来约每秒 1500 token 的生成速度。这件事说明,构建文本扩散模型不一定要从头训练。

Google DeepMind 将现成的 Gemma 4 模型改装成文本扩散模型 DiffusionGemma,只用不到 10% 的训练数据预算,换来约每秒 1500 token 的生成速度。这件事说明,构建文本扩散模型不一定要从头训练。

英国就业法庭因工人使用 ChatGPT、Grok 免费起草诉讼申请而案件激增,积压待审案件一年间升至 6.4 万件;AI 降低了发起法律纠纷的门槛,也在系统层面放大了司法成本。

AI 图像生成工具 PromptPic 在 Product Hunt 上线,聚焦提示词(Prompt)与图片生成流程的衔接。当前 AI 生图工具虽多,但提示词编写、管理和复用仍是创作效率的瓶颈,这类工具的价值正被市场重新评估。

Product Hunt 上出现了一款名为“Gemini水印去除器”的工具,专门移除 Google Gemini 生成图片中的水印标识。它触动了 AI 生成内容溯源与平台治理的敏感地带,也反映出围绕生成式 AI 的灰色工具链正在快速成形。

Product Hunt 上出现了一款名为 Custos 的 AI 智能体安全工具,定位是“AI Agent 的守门人”,专门负责拦截智能体的越权操作和危险行为。它反映了 AI 行业从“让 Agent 能干活”转向“确保 Agent 不乱干活”的新阶段。

AI 算力需求的爆发正在把电力变成稀缺资源,Nvidia 和 Amazon 计划投入数十亿美元自建电力基础设施,以保证 GPU 工厂和数据中心能持续运转。

Anthropic的Ultracode编程模式在Kill My SaaS比赛中被证实只需3个提示词就能完成一个完整的参赛方案,开发者社区开始认真看待动态工作流带来的效率变革。

一项以IMDb影评数据为测试场的情感分析研究,系统对比了轻量级微调方案DistilBERT LoRA与经典TF-IDF基线在性能、校准、可解释性与半监督学习上的表现。它提醒AI行业在追逐大模型的同时,简单基线和小模型微调依然有实用价值。

Meta CTO Andrew Bosworth在内部问答中明确拒绝员工将AI效率提升用于换取更多休假的提议,强调应把省下的时间投入产品开发。这是大型科技公司首次如此直白地表明:AI红利属于公司而非员工。

中国AI发展正在遭遇新的硬约束——高质量中文训练数据即将不够用。中文仅占全球网页内容的1.3%,且微信、抖音等平台数据不对外开放,这一结构性缺口或比芯片限制更难绕开。