基于 Lean 的忠实性对齐评估

基于 Lean 的忠实性对齐评估

Millennium Research 发布了一款名为 leanscreen 的开源工具,用于检查 Lean 4 定理陈述是否存在“空洞承诺”——比如证明能编译通过,但定理本身只是恒等式,实际意义为空。这类问题正是大模型生成形式化证明时最隐蔽的风险点。

OpenSSH 10.5 发布,现已支持 AI 辅助

OpenSSH 10.5 发布,现已支持 AI 辅助

OpenSSH 10.5 正式发布,团队同时公开表示欢迎 AI 辅助提交的安全漏洞报告,前提是有人工研判、测试用例或修复建议。开源安全社区对“是否接受 AI 进代码树”仍有明显分歧,但至少在漏洞挖掘环节,AI 已被权威基础设施项目官方接纳。

Codex Security,开源了!

Codex Security,开源了!

OpenAI 将旗下 AI 安全插件 Codex Security 正式开源,以 npm 包形式向所有人开放,并支持接入第三方大模型。这意味着 AI 编程工具正在从“生成代码”走向“自动审计代码安全”,开发者可以低成本为任何 Agent 工具加上安全外挂。

AI 工程师必备的 7 条自改进智能体循环规则

AI 工程师必备的 7 条自改进智能体循环规则

Google Cloud 团队开源了编码智能体工具 agents-cli,把“构建智能体、找出失败、改写、再运行”的自改进循环自动化。这个循环的关键短板是:智能体会优化你给它的指标,但不会判断指标本身对不对,因此定义“什么算好”成为 AI 工程师的新核心工作。