OpenAI伦理主管Chloé Bakalar为何离职?

OpenAI伦理主管Chloé Bakalar离职,引发关于AI公司内部伦理角色是否只是“安全公关”的讨论。HN用户认为,OpenAI与Anthropic将AI描述为“可能带来无限危害或收益的独特技术”,伦理团队的实际约束力存疑。

OpenAI伦理主管Chloé Bakalar离职,引发关于AI公司内部伦理角色是否只是“安全公关”的讨论。HN用户认为,OpenAI与Anthropic将AI描述为“可能带来无限危害或收益的独特技术”,伦理团队的实际约束力存疑。

安全研究者展示了一种针对专有大语言模型 API 的攻击思路:通过精心构造的查询,可以诱导模型暴露内部推理轨迹,从而在未接触权重的前提下,低成本获取闭源模型最核心的“思考过程”。

安全研究机构 A Security 用不到 20 条公开 AI 模型提示,发现并复现了 Zoom 的严重漏洞,可让攻击者远程接管会议中所有设备。Zoom 已于周二发布修复补丁,这件事真正值得关注的是:AI 正在把“国家级”漏洞挖掘能力交到个人研究者手里。

英伟达被曝正在开发新一代开源大模型 Nemotron 4,最大版本预计拥有至少一万亿参数,目标直指全球顶级开源模型。这不仅是模型竞赛,也是英伟达用开放生态拉动其 GPU 算力需求的关键布局。

Spotify 推出 AI Persona 标签,用于区分真实艺术家与 AI 伪造或虚拟的创作者身份,目标是提升平台可信度;但该机制针对的是“人设与身份”而非音频内容本身。

Spotify 将为那些以真人形象示人、但实际由生成式 AI 驱动的音乐人账号添加“AI Persona”标识,并将这些内容的个性化推荐默认关闭,这是主流流媒体平台首次大规模公开标注 AI 音乐人身份。

安全公司 A Security 用公开 AI 模型、不到 20 次提示就发现了 Zoom 屏幕共享注释功能中的高危漏洞,攻击者可静默接管通话中任意成员的设备。这件事说明 AI 漏洞挖掘的门槛正在急剧降低。

<strong

NVIDIA 发布 Nemotron 3.5 Lightning,一个面向长时间运行 AI Agent 的轻量级开源模型(30B 参数、3B 活跃参数),专注工具调用、结果验证等高吞吐执行任务,用低成本换取高速度,同时推出 NeMo Switchyard 路由库,让不同任务自动分发给最合适的模型。

Spotify 计划在 9 月中旬为“不代表真实人物”的 AI 生成档案上线 Persona 标签,用“人工审核+AI 工具”双重机制给 AI 内容打标记,平台治理开始从内容层面延伸到身份层面。