Prompt 不是真实存在的

Hacker News 上一场讨论提出,与其让各家 AI 产品各自绑定自家工具和前端,不如把 AI 当作你自己带上下文的“个人中间层”,由它来调用外部工具和 API。这背后是对 Prompt 本质的重新审视:Prompt 可能并不是一个独立存在的东西,而是用户意图、上下文和工具接口的临时组合。

Hacker News 上一场讨论提出,与其让各家 AI 产品各自绑定自家工具和前端,不如把 AI 当作你自己带上下文的“个人中间层”,由它来调用外部工具和 API。这背后是对 Prompt 本质的重新审视:Prompt 可能并不是一个独立存在的东西,而是用户意图、上下文和工具接口的临时组合。

Hacker News 上一场关于 AI 编程的讨论指出,LLM 生成代码正让开源项目和团队被低质量 PR 淹没,而审查 AI 代码比亲手写代码更累。问题的关键不在 AI,而在软件开发流程和质量管理没有随之调整。

Hacker News 上围绕“编排 Claude Code Agent 的幕僚长模式”展开讨论:让 AI 代理像幕僚长一样统筹子任务可以提效,但多数开发者仍只敢把它用于琐碎工作,关键开发环节必须人工盯守。
![[Bug]: Qwen3.5 structured output doesn't work](https://www.chat-gpts.plus/wp-content/uploads/2026/09/35700-bd9ee480-768x403.jpg)
在 vLLM 上通过 OpenAI 兼容接口为 Qwen3.5 提供 structured output 时,thinking 模式下返回的 JSON 可能被 markdown 代码块包裹(如 ```json ... ```),或在启用 MTP 投机解码时违反 response_format 约束。
![[Model Support] DeepSeek-V4.1 Tracking Issue](https://www.chat-gpts.plus/wp-content/uploads/2026/09/56400-8f0f3572-768x403.jpg)
这是 DeepSeek-V4.1(DSv4.1)模型支持的 Tracking Issue,不是单一报错。若你在 vLLM 加载 DeepSeek-V4.1-Flash 时遇到模型无法解析(如 [Model Support] DeepSeek-V4.1 Tracking Issue )、ROCm 段错

当你通过 API 或前端发送补全请求时,如果请求体中没有携带 tool_ids ,即使在模型编辑器中已经为工作区模型配置了工具( meta.toolIds ),这次请求也会在没有任何工具的情况下静默执行。优先排查客户端是否发送了 tool_ids ,以及模型配置的工具是否被前端状态正确同步。

知名黑客 Andy Nguyen 宣布放弃“PS5 Linux”项目,原因是有人用大语言模型发现并上报了同一个 hypervisor 漏洞,导致 Sony 提前修复。这既是主机破解圈的路线之争,也折射出 AI 正在改变漏洞挖掘的门槛与游戏规则。

作家 Erich Grunewald 在 Substack 发文主张:几乎不要用 AI 撰写博客、报告、备忘录等有实质观点的文本,理由是写作本身就是思考过程,而 AI 生成的文字往往“含糊且难以察觉地出错”。
![[Bug]: Refine/CompactAndRefine streaming collapsed to a single chunk since 0.14.22 (#21374)](https://www.chat-gpts.plus/wp-content/uploads/2026/09/22831-856a571a-768x403.jpg)
当你在 LlamaIndex 0.14.22 及之后版本中使用 Refine 或 CompactAndRefine 并开启 streaming=True 时,流式输出会退化成一次性返回单个 chunk(完整答案在生成结束后才吐出),核心报错表现为:[Bug]: Refine/CompactAndRe

这个报错通常发生在 llama.cpp 以全量 GPU offload 加载 qwen4exp / deepseek-v4 后、首次 decode 阶段;最先排查的是容器或启动环境里是否误设了 embeddings-only 相关变量(如 LLAMA_ARG_EMBEDDINGS=true ),而不