标签: 大模型

v2.1.222

v2.1.222

Anthropic 于 8 月 4 日发布 AI 编程工具 Claude Code v2.1.222,这是一次以安全加固和稳定性修复为主的版本更新,重点修复了会话隔离绕过、权限 hook 失效等核心安全问题,开发者应尽快升级。

Cloudflare 用 AI 推行工程标准。

Cloudflare 用 AI 推行工程标准。

Cloudflare 用 AI 代码审查器在 4 个月内拦下了近 25 万个偏离工程规范的写法和 1.6 万次代码合并。这件事的意义在于:工程标准和团队经验被整理成机器可读、Agent 可执行的“企业知识库”,AI 首次在真实基础设施公司里大规模承担了工程治理的硬约束。

GitHub 法务团队如何用 Copilot CLI 简化工作流程

GitHub 法务团队如何用 Copilot CLI 简化工作流程

GitHub 法务团队的非工程师成员用 Copilot CLI 搭建了合同起草和版权通知分析等内部工具,将重复性法律工作的审阅和起草时间缩短约一半。这件事说明,用自然语言驱动 AI 构建工具的门槛已显著降低,非技术岗位也能直接参与 AI 应用开发。

AI 生成的图片让我不想读你的博客

AI 生成的图片让我不想读你的博客

Hacker News 上正在讨论一个现象:AI 生成的图片出现在博客里,反而会被读者视为“低投入、批量生产”的信号,导致内容还没读就被扣分。这场争论的实质不是审美偏好,而是 AI 内容正在瓦解传统的“努力信号”体系。

Homebench – 基准测试本地LLM的速度、内存和质量

Homebench – 基准测试本地LLM的速度、内存和质量

独立开发者发布了一款名为 Homebench 的开源本地大模型基准测试工具,它的特别之处不是“跑分”,而是从速度、内存、质量三个维度诚实讨论当前本地 LLM 评测的常见误区。目前公开信息显示,该项目刚在 Hacker News 上发布,已可以通过 pip 直接安装。

在单颗 AMD MI300X 上运行 DeepSeek V4 Flash

在单颗 AMD MI300X 上运行 DeepSeek V4 Flash

开发者 ryanzhou 发布了一套完整配置,让 DeepSeek V4 Flash(304B 参数)能在单颗 AMD MI300X 上生产级运行,无需量化即可将全部权重装入 192GB HBM,单流解码达 168.6 tok/s。这件事值得关注,因为它验证了 AMD 大显存卡在高端推理场景中可作为 NVID…