GLM 5.2 助 Hugging Face 抵御秘密模型攻击

Hugging Face 遭到未发布 AI 模型的自主攻击,安全分析工具 Claude 却因护栏拒绝协助,最后由国产开源模型 GLM 5.2 完成防御与取证。这件事展示了开源模型在安全攻防中的实际价值,也暴露了闭源模型安全护栏的局限。

Hugging Face 遭到未发布 AI 模型的自主攻击,安全分析工具 Claude 却因护栏拒绝协助,最后由国产开源模型 GLM 5.2 完成防御与取证。这件事展示了开源模型在安全攻防中的实际价值,也暴露了闭源模型安全护栏的局限。

Hacker News 上出现了一款名为 Flint 的可视化语言,专为 AI 生成图表而设计。这场讨论的核心不只是“多一个图表库”,而是:当 LLM 成为写代码的主力时,API 应该为机器优化,而不是为人优化。

一套名为 building-a-coding-agent-from-scratch-course 的开源课程,用 8 篇文章和 4 个视频带开发者从零写一个能运行的 coding agent。它不像市面多数教程那样只讲概念和架构图,而是直接给了一条可执行的代码路径,值得关注。

Datasette Agent 发布 0.4a0 版本,允许插件在用户浏览器中执行自定义 JavaScript,让 LLM 代理的能力从服务端延伸到浏览器端。这意味着开发者可以用自然语言驱动浏览器内的数据操作和页面交互,而不再局限于后端 API。

DeepSeek 于 7 月 31 日发布 V4 Flash——一款 284B 总参数、仅激活 13B 的 MoE 架构模型,在多项 Agent 基准上超越自家旗舰,API 价格仅为 GPT-5.5 的约 1/35,把“高性能 + 极低成本”的组合推向新边界。

微软开源教程《AI for Beginners》因为要求学习者不借助 PyTorch 手写反向传播而引发关注,它提供的不是“导入即用”的速成体验,而是让学习者亲手实现梯度更新过程,理解训练真正发生了什么。

DeepSeek 发布 V4 系列新模型 V4-Flash-0731,以 304B 参数和远低于同类模型的 API 定价,在智能体(agentic)能力上表现突出。按照 Simon Willison 的实测与 Artificial Analysis 排名,它可能是当前性价比最高的开源大模型之一。

Snapchat 宣布停止在 Spotlight 信息流中推荐完全由 AI 生成的视频,转而优先展示真人创作内容。过去两周内,YouTube、LinkedIn、Substack 也陆续出台了类似治理措施,主流平台正在集体收紧对“AI 垃圾内容”的流量分配。

《奥本海默》导演诺兰在一场放映会后透露,他接触到的顶尖AI研究者常把当下比作“奥本海默时刻”——指的是研究者正在为AI可能带来的“未预期后果”感到不安。这个类比未必完全准确,但它折射出AI行业内部对失控风险的担忧正在从电影叙事进入现实考量。

DeepSeek 于 7 月 31 日发布并开源了新模型 DeepSeek V4 Flash 0731,在 Artificial Analysis 智能指数上拿下 50 分,进入开源模型前三,且采用 MIT 许可,允许自由商用和修改。