AI应用:得效果者得新进,得关系者得留存

AI 应用开发者洛小山提出,标准化工具赛道里单点效果领先只能维持一两个月,而沉淀了交互人格与协作默契的产品,用户切换成本极高,因此壁垒应从"效果"转向"关系"。

AI 应用开发者洛小山提出,标准化工具赛道里单点效果领先只能维持一两个月,而沉淀了交互人格与协作默契的产品,用户切换成本极高,因此壁垒应从"效果"转向"关系"。
![[Bug]: assistant_tokens_mask misaligned after multimodal placeholder expansion](https://www.chat-gpts.plus/wp-content/uploads/2026/09/57223-39345890-768x403.jpg)
当你在 vLLM 中开启 return_assistant_tokens_mask=True ,并且 prompt 里带有多模态占位符(audio / image / video)时,占位符展开后 assistant_tokens_mask 的条目数少于 token 数,导致第 9 位之后的 mas

该报错通常出现在 vLLM 把 --gpu-memory-utilization 调得很高(如 0.98)、同时启用 CUDA graph capture 的场景:启动时的显存检查通过并按估算值分配了偏大的 KV cache,随后真实的 CUDA graph capture 却因显存不足抛出 CUD

当 LangChain Agent 使用 HumanInTheLoopMiddleware 且人工选择 edit 决策时,编辑后的工具调用会正常执行,但 Agent 在下一步仍会基于原始工具调用重新规划,导致再次发起原始(未编辑)的工具调用,并可能让最终回复引用旧参数。优先排查中间件修改 AIMes

OpenRouter 用同一句提示词实测了 20 个图像生成模型,发现单张图成本从 0.006 美元到 0.134 美元不等,相差约 22 倍,且计费单位五花八门,直接比价并不可靠。

《纽约时报》等多家美国媒体在纽约联邦法院提交联合简易判决动议,引用 OpenAI 与微软高管的内部邮件、Slack 消息和宣誓证词,反过来质疑两公司的“合理使用”抗辩;原告索赔金额达数十亿美元。

Gary Marcus 在 9 月 18 日的评论中提出,近期真正该警惕的不是失控超级智能,而是智能体 AI(Agentic AI)被滥用后引发的规模化网络攻击;同一时间,安全团队 s1r1us 声称利用两个漏洞接管了 OpenAI 员工的 ChatGPT/Codex 账号并触达 Outlook、Slack…

2026 年春季,美军一份由 AI 聊天机器人参与生成的情报报告误判一艘中东中国船只运载核武部件,军方一度准备登船拦截,行动前才发现报告“完全失实”。这件事把大模型幻觉从“答错问题”推到了“可能引发国家冲突”的层级。

Ethan Mollick 指出,GPT-6 Astra 与 Fable 5.1 现有能力已足以完成数周人类工作量,但绝大多数用户几乎没用到。真正的差距不在模型,而在人是否带上了自己的判断力与品味。

GitHub 在最新一期播客中集中拆解了几个流行的 AI 热梗,包括“不用读 AI 生成的代码”“Skills 杀死了 MCP”“RAG 已死”。核心结论是:这些说法大多把复杂工程问题压缩成了一句口号,实际落地时并不成立。