角色混淆导致提示注射

研究人员发现,大语言模型(LLM)更容易被文本“风格”而非实际内容欺骗,导致角色标签(如 、 )之间的边界失效。一种叫“去风格化”的简单改写,就能让攻击成功率从61%骤降至10%,揭示了当前模型在感知自身角色上的根本性软肋。

研究人员发现,大语言模型(LLM)更容易被文本“风格”而非实际内容欺骗,导致角色标签(如 、 )之间的边界失效。一种叫“去风格化”的简单改写,就能让攻击成功率从61%骤降至10%,揭示了当前模型在感知自身角色上的根本性软肋。
![[程序员] 除了 chartgpt、claude code,还有其他好用的 AI 推荐吗?](https://www.chat-gpts.plus/wp-content/uploads/2026/06/ai_cover_1-860-768x403.jpg)
一位程序员在 V2EX 询问除了 ChatGPT 和 Claude Code 之外,还有哪些 AI 工具适用于软件开发,社区推荐集中在 Cursor、ZCode、OpenCode 等针对编码优化的特定产品上,但讨论焦点很快转向了模型可用性的实际问题。

智谱AI计划于今年8月正式发布新一代基础大模型GLM-5.5,据称参数规模或突破万亿。此前因美国对Anthropic两款顶尖模型实施访问限制,全球大模型竞争格局出现空隙,智谱正借此窗口加速追赶全球第一梯队。

一个开源实验项目测评了13种主流大语言模型对291位公众人物的“了解程度”,发现模型间知识库覆盖差异悬殊(置信度从90到18不等),但不同模型对人气的排序高度相似(0.65相关系数)——这意味着大模型的“知识边界”比我们想象得更随机。

Hacker News 用户围绕“如何让 LLM 生成高质量代码”展开讨论,核心观点是:不要指望 LLM 自动产出优质代码,关键取决于开发者如何构建提示词(prompt engineering)、拆分任务以及迭代验证,而非模型本身。

智谱在 6 月 13 日开源的 744B 参数模型 GLM-5.2,在长程强化学习阶段放弃了开源社区广泛使用的 GRPO 算法,转向带价值网络的 PPO。这一技术选择,第一次把“GRPO 在长程任务上不适用”这个业界传闻,摆在了公开且可复现的技术博客里。

一款名为 SEO Fragments 的 AI 驱动 SEO 平台在 ProductHunt 上线,提供 117 种工具,目标是在传统谷歌排名之外,帮助网站被 ChatGPT、Gemini、Claude 等 AI 搜索引擎引用,号称有永久免费计划与 BYOK(自带密钥)AI 支持。

AI QuizFactory 今日在 Product Hunt 上线,这是一款面向教师、培训师和辅导机构的 AI 测验生成工具,核心卖点是快速从主题、文本、PDF 等材料生成专业测验并自动批改。对教育领域的 AI 应用落地来说,这代表“AI + 教学评估”正进入低门槛、高自动化的实用阶段。

英国《金融时报》Lex专栏指出,在算力和数据之外,劳动者的接受度、技能匹配度与适应速度,正成为制约AI大规模落地的关键瓶颈。这一观点点出了当前行业“技术跑得快、人跟不上”的现实困境。

ImgToolsHub 发布了一个精选 AI 图像工具目录,集合了图像生成、编辑、放大和背景移除等主流工具,旨在帮助创作者和开发者快速对比和筛选合适的工具,减少因新品频繁发布导致的评估成本。