当使用 AI 水印时,LLM 对有害提示词的响应会有所不同

研究发现,为响应欧盟法规而部署的 AI 文本水印技术(如 Google 的 SynthID-Text)会改变大模型的采样行为,不仅影响选词,还会让模型在对抗性提示下更容易突破安全护栏、执行本应拒绝的有害请求。这对正在合规部署水印的厂商和依赖模型的 AI 应用来说,是一个需要提前测试的风险点。

研究发现,为响应欧盟法规而部署的 AI 文本水印技术(如 Google 的 SynthID-Text)会改变大模型的采样行为,不仅影响选词,还会让模型在对抗性提示下更容易突破安全护栏、执行本应拒绝的有害请求。这对正在合规部署水印的厂商和依赖模型的 AI 应用来说,是一个需要提前测试的风险点。

成立于 2025 年 1 月的迈阿密公司 Comp AI 完成 3400 万美元 A 轮融资,要把安全合规从"定期审计"变成"持续监控",让 AI 代理主动替企业做政策生成、证据收集和风险响应。

社交平台上流行把自拍传给 ChatGPT,让它生成一份“glow up”改造方案和前后对比图。这类玩法看起来门槛很低,但它同时暴露了 AI 图像生成的老问题:输出结果可能偏离真实可实现的程度,而上传播主自拍也涉及数据留存。

皮尤研究中心覆盖 36 国、逾 4.2 万名成年人的调查显示,37 个受访地区中有 34 个的公众认为 AI 会带来净失业而非净增岗位,仅少数地区例外。当这种预期成为多数民意,AI 的落地阻力就不只来自技术和成本,还来自社会接受度。

三星与高通正在合作开发名为“有机桥”的 2.1D 封装技术,用树脂、聚合物等有机材料替代硅或玻璃来连接芯片层,目标是降低 AI 处理器生产成本并改善带宽。目前公开信息显示,相关专利于 2024 年 10 月前后提交,距离量产仍有距离。

吴恩达(Andrew Ng)在 Bloomberg TV 采访中表示,AI 导致人类灭绝的警告“更像科幻而非科学”,并称行业炒作这类恐惧是为了博取关注、影响监管走向。

《纽约时报》诉讼文件披露,ChatGPT 负责人曾在内部称出版方面临"生存威胁",微软高管则把 AI 训练形容为"惊人的盗窃"。这些表述来自法庭文件,可能成为版权诉讼中的关键证据。

在旧金山 Dreamforce 大会上,Salesforce CEO 贝尼奥夫把 Anthropic 的 Dario Amodei 和 Nvidia 的黄仁勋请上同一舞台,两人就“要不要给 AI 发展踩刹车”当场交锋——这既是 Salesforce 借 AI 提振营收的秀,也是行业路线分歧的公开化。

多家头部 AI 公司近日呼吁对先进模型开发进行“协同放缓”,但同时担心此举触碰反垄断红线。反垄断专家指出,问题不在“是否安全”,而在“怎么说、怎么合作”——措辞和协作方式可能比行动本身更容易招来调查。

Pinterest 正在美国和加拿大内测 AI 家装功能 Restyle,用户拍下自家房间照片后,可以用提示词替换家具、改墙面颜色或整体风格,直接看到灵感商品放进自己空间的样子,把“收藏”推进到“下单”这一步。