[Bug]: Qwen3 thinking switch sends enable_thinking outside chat_template_kwargs for vLLM
![[Bug]: Qwen3 thinking switch sends enable_thinking outside chat_template_kwargs for vLLM](https://www.chat-gpts.plus/wp-content/uploads/2026/08/18595-8011a420-768x403.jpg)
该报错发生在 RAGFlow v0.26.4 通过 OpenAI 兼容接口对接本地 vLLM 部署 Qwen3 系列模型时,由于 enable_thinking 参数被错误地放在请求体顶层而非 chat_template_kwargs 中,导致 vLLM 静默忽略该参数,Qwen3 模型始终以思考模
![[Bug]: Qwen3 thinking switch sends enable_thinking outside chat_template_kwargs for vLLM](https://www.chat-gpts.plus/wp-content/uploads/2026/08/18595-8011a420-768x403.jpg)
该报错发生在 RAGFlow v0.26.4 通过 OpenAI 兼容接口对接本地 vLLM 部署 Qwen3 系列模型时,由于 enable_thinking 参数被错误地放在请求体顶层而非 chat_template_kwargs 中,导致 vLLM 静默忽略该参数,Qwen3 模型始终以思考模

Vercel 将 AI 应用构建智能体 v0 以 API 形式开放,开发者可以在自己的产品、脚本或 CI 流水线中调用它生成、迭代并部署应用。这意味着 AI 生成应用的能力从“网页里的玩具”变成了可编程的基础设施。

SAP与电竞俱乐部Team Liquid合作推出AI语音应用,把比赛和训练中的队内语音自动转成带时间戳的结构化数据,帮助战队复盘战术、评估选手状态。这是AI语音技术从通用转写走向垂直行业数据分析的一个具体案例。

Liquid AI 与 Hugging Face 联合发布 LFM2.5 系列三个核心模型的 DSpark 草稿模型,通过投机解码将 GPU 推理吞吐量最高提升 3.18 倍,且不改变模型输出质量,为边缘设备运行 agent 应用扫清了性能障碍。

MIT 博士 Raj Dandekar 用 252 美元租用单张 H200,花费 50 亿 token 从零预训练了一个 10.2 亿参数的迷你版 Kimi K3,并以免费电子书形式完整公开了训练日志,包括官方代码的隐藏 Bug 与失败实验。这件事的价值不在于“复刻成功”,而在于把大模型预训练从黑盒变成了可重…

一款代号 Ox Alpha 的神秘中国大模型正在 OpenRouter 和 OpenCode 上匿名内测,具备 100 万上下文窗口和原生多模态能力,且承诺测试期间零数据保留。社区根据 Tokenizer 指纹和行为特征,正猜测它来自小米 MiMo 系列或智谱 GLM 家族。

知名科技评论者 lidang 发布了一份“鉴定当代科技大傻逼的10个问题”,集中嘲讽了中文互联网上关于中国 AI 碾压美国、宇树机器人包打天下、大模型靠电力取胜等十类流行叙事。这份清单本身不是新闻,但它精准折射出当前 AI 舆论场中信息失真与情绪化判断的严重程度,值得从业者警惕。

X 平台(原 Twitter)用户 @shabi666woc 在周日(8月21日)发布了一条关于“牛大语言模型”(Niulai Large Language Model)的讨论帖,指出该模型命名中不应省略“Large”一词。截至发稿,该帖浏览量仅 6 次,引发关注有限,但讨论涉及国产大模型命名规范与传播策略的…

健康 AI 项目 4Heal 在连续完成两轮数百万美元战略融资后,正试图打通智能穿戴、体检报告与日常健康数据,构建一个由 AI Agent 驱动的去中心化个人健康管理平台。

豆包桌面端任务模式迎来一次重大更新,新增技能、连接器与工作伙伴三大功能,让这款产品从对话助手进一步转向智能办公平台,也把个人工作方法与外部工具、垂直智能体连接在了一起。