标签: 算力

DiffusionGemma Technical Report

DiffusionGemma Technical Report

Google 的 DiffusionGemma 技术报告发布,展示了一种不逐字生成、而是并行细化 256 个 token 的离散扩散语言模型。它基于 Gemma 4 微调而来,推理速度可达单张 H100 上每秒约 1500 token,显著快于传统自回归模型。

请勿粘贴AI生成内容

请勿粘贴AI生成内容

Hacker News 上一场关于“AI 代写工作沟通”的争论,指向一个被忽视的核心问题:当员工把 AI 生成的文字直接粘贴给同事或客户时,被省掉的不是工作量,而是思考本身。这场讨论的实质,是 AI 时代“输出责任”的重新定义。

在大型语言模型中探索意识

在大型语言模型中探索意识

《经济学人》刊发深度互动报道,探讨大型语言模型(LLM)内部是否可能涌现意识,以及这种可能性如何颠覆我们对智能与机器关系的既有认知。该话题虽处科学前沿,但已开始影响公众对AI的预期和伦理讨论。

CloudFlare 预览网页 WebMCP 自动支持功能

CloudFlare 预览网页 WebMCP 自动支持功能

Cloudflare 推出开发者预览功能,让部署在其平台上的网站能通过一个开关启用 WebMCP 标准协议,直接向 AI 智能体暴露结构化工具接口,而非靠抓取网页或模拟点击来交互。这个方向可能改变 AI 智能体与网站互动的方式,把流量和数据主权留在站点本身。

AI 数据中心监管有了新模板,无需新立法

AI 数据中心监管有了新模板,无需新立法

美国宾夕法尼亚州提出了一套针对AI数据中心的新监管框架,试图在无需新增专项立法的情况下,用现有电力、环境和建筑规则来约束算力基础设施建设。这套“模板”可能成为其他州参考的样本,影响未来AI算力的落地区域与审批节奏。