Show HN: ReasonGate——可解释的门控,阻止LLM提示注入

开发者发布了一款名为 ReasonGate 的开源安全工具,专门拦截针对大语言模型(LLM)应用的提示注入攻击。与现有方案不同,它不仅能阻断攻击,还会清晰记录拦截原因,帮助开发者和安全团队审计和验证决策。

开发者发布了一款名为 ReasonGate 的开源安全工具,专门拦截针对大语言模型(LLM)应用的提示注入攻击。与现有方案不同,它不仅能阻断攻击,还会清晰记录拦截原因,帮助开发者和安全团队审计和验证决策。

苹果以窃取硬件机密为由起诉OpenAI,涉及前苹果高管疑帮助挖角并带走未发布产品的设计;与此同时,纽约州通过全美首个数据中心禁令,OpenAI内部员工则成立政治行动委员会推动AI安全立法。

xAI 发布了 Grok 的 Automations(自动化)功能,允许用户设定一次任务指令后,由 Grok 按固定时间表或特定邮件到达时自动执行,并主动通过 App 通知或邮件返回结果。这一更新将 Grok 从一个被动对话助手,扩展成一个能主动调度、持续服务的自动化工具。

Daring Fireball 创始人 John Gruber 在最新一期播客节目《Dithering》中,对苹果起诉 OpenAI 一事发表了不同于主流媒体解读的观点。该期节目已免费公开,供听众了解他的独特分析视角。

苹果在诉讼中指控OpenAI“从未回应”其关于商业秘密盗窃的担忧,但NBC新闻获取的邮件显示,OpenAI事实上在二月就做出了回应。真正导致沟通中断的,是一名苹果外部律师误将发给员工Wang的邮件发给了员工Chang,这一混淆让OpenAI方面误以为问题已解决。

OpenAI就Apple提起的商业机密盗窃诉讼发表第二份声明,措辞微妙地从“指控没有依据”转向“我们没有看到有依据的证据”,引发外界对案件实质争议的重新审视。

Anthropic 正推动美国各州对最强大的 AI 系统实施更严格的监管,包括第三方审计和司法强制措施,认为仅靠透明度和自愿报告已不足以应对快速提升的 AI 能力。

据 Bloomberg 报道,Google 下一代 Gemini Pro 大模型因编程能力未达内部指标,进度已落后数月,原定在 5 月开发者大会发布的计划可能推迟。这一延误正加速资深工程师流向 Anthropic 和 OpenAI,进一步拉大 Google 与竞争对手在代码生成领域的差距。

标准普尔于7月9日将Oracle信用评级下调至BBB-,距垃圾级仅一步之遥。原因是其斥资2500亿美元建设AI数据中心的计划导致自由现金流大幅恶化,债券市场已提前按垃圾债定价其10年期债券。

知名风投 Founders Fund 宣布聘请前 OpenAI 产品政策副总裁 Ryan Beiermeister 出任合伙人。她的履历中包括在 OpenAI 因反对“成人模式”而被解雇的争议事件,以及在一档 YouTube 节目中与多位硅谷大佬玩“黑手党”游戏表现出的策略能力,但基金方明确表示,招聘并非因为…