标签: OpenAI

OpenAI publishes a technical report on the Hugging Face incident, detailing the agents’ activity, safeguard failures, and measures to prevent recurrence (OpenAI)

OpenAI publishes a technical report on the Hugging Face incident, detailing the agents' activity, safeguard failures, and measures to prevent recurrence (OpenAI)

OpenAI 就此前发生在 Hugging Face 平台上的账号安全事件发布技术报告,详细还原了恶意代理的活动路径、安全防护机制失效的原因,并提出了后续加固措施。这是少见的由头部大模型公司主动公开的攻防细节复盘,值得开发者和企业安全团队关注。

OpenAI称已挫败俄罗斯利用ChatGPT传播虚假信息的恶意计划

OpenAI称已挫败俄罗斯利用ChatGPT传播虚假信息的恶意计划

OpenAI 宣布捣毁了一个疑似源自俄罗斯的社交影响力操控活动,攻击者利用 ChatGPT 账号伪装成“国际智库”专家,试图营造俄罗斯优于西方国家的舆论氛围。此事值得关注的点在于,大模型本身没有“作恶”,但作为内容分发与信誉背书工具,它正被更精巧地纳入现代信息战的基础设施。

AI的风险确实存在,但可控(2023)

AI的风险确实存在,但可控(2023)

比尔·盖茨在近期发布的文章《AI的风险确实存在,但可控》中,系统回应了外界对人工智能的担忧,主张通过主动监管和技术设计来管理风险,而非因噎废食。这篇讨论由 Hacker News 转载传播后,再次引发关于大模型安全与商业化边界的争论。

使用 Accept 标头向 AI Agent 提供 Markdown

使用 Accept 标头向 AI Agent 提供 Markdown

一个名为 Accept Markdown 的开源倡议正在推动网站通过内容协商(Content Negotiation),向 AI Agent 直接输出 Markdown 格式的正文,以替代传统的 HTML 网页。这项机制能让 AI 在抓取网页时跳过导航、脚本和样式代码,用极少的 Token 读取核心内容。