Pirate Face 从删除中拯救 LLM 模型

Hacker News 上围绕 antirez 的 DS4 项目展开讨论:与其事后“删除”模型权重中的拒答倾向,不如在推理运行时对激活值做正交化,直接加载未经改动的原始权重。这关系到开源大模型的安全对齐方式、量化精度,以及云推理服务的合规边界。

Hacker News 上围绕 antirez 的 DS4 项目展开讨论:与其事后“删除”模型权重中的拒答倾向,不如在推理运行时对激活值做正交化,直接加载未经改动的原始权重。这关系到开源大模型的安全对齐方式、量化精度,以及云推理服务的合规边界。

Hacker News 上围绕“ChatGPT 通过广告收集器获取用户在其他网站活动”的讨论,把广告追踪、端到端加密后门和欧盟隐私监管三件事放到了同一张桌面上:消费端被默认开启的追踪机制,仍然是当下最现实的隐私风险。

softwarecrisis.dev 作者提出,基于对话的大语言模型之所以让人觉得“有智能”,机制上更像通灵师的冷读术——用听起来很具体、实则统计上普适的说法让用户自行对号入座。这一判断把“AI 是否在推理”的争论,拉回到用户体验层面的心理机制。

DAIR.AI 在其 Academy 上线了名为 Jev 的新课程与资源集合,聚焦用 Claude Code 进行“氛围编程”(Vibe Coding)来构建 AI 应用,并配套了可交互的社区示例库。这反映了 AI 教学正从“讲原理”转向“讲怎么用命令行 Agent 把应用真的做出来”。

一个新工具 Jev 被 Vercel、Cloudflare 等平台快速接入,主打更快、更便宜地挑选 AI 工具;TypeSafe 称其表现已能对标 GPT-5.6 和 Sonnet 5 的工作流评测,这意味着 AI 工具选型正在从“人工比价试错”走向“自动化评测匹配”。

Hacker News 上一场讨论提出,与其让各家 AI 产品各自绑定自家工具和前端,不如把 AI 当作你自己带上下文的“个人中间层”,由它来调用外部工具和 API。这背后是对 Prompt 本质的重新审视:Prompt 可能并不是一个独立存在的东西,而是用户意图、上下文和工具接口的临时组合。

在 Hacker News 引发讨论的一篇工程笔记中,有 25 年经验的洛杉矶工程师 Dan 提出:把大模型真正部署给消费者使用时,prompt 的重要性被高估了,真正决定 agent 可靠性的,是对失败率的持续测量与约束。

Salesforce 在 Dreamforce 2026 上用 AI agent「tAIster」现场测试品酒:它学了约 40 万款葡萄酒信息,靠用户口述猜杯中酒,三杯里猜对两杯,第三杯把霞多丽误判成香槟。这更像一次市场演示,而非能力验证。

四名消费者于9月18日在加州北区对Anthropic、OpenAI、SpaceXAI和Google提起集体诉讼,指控它们就“放缓前沿模型能力提升速度”达成横向协议,违反《谢尔曼法》第一条。这起案件的特别之处在于:证据几乎全部来自四家公司高管的公开表态,没有一封泄露邮件。

微软AI负责人Mustafa Suleyman公开为行业"放缓AI开发节奏"的协调行为辩护,而同一天四名消费者在旧金山提起反垄断诉讼,指控这种协调本质上是竞争对手联手限制产品进步;扎克伯格拒绝加入该协调的理由,恰好与原告的论点高度一致。