快速结论:这个报错发生在使用 `llama-server` 的 `–models-preset` 加载包含 `version = 1` 键值对的 INI 配置文件时,会在 `/models` 端点意外暴露一个空白的“default”模型条目。优先排查是否在 INI 文件顶部写入了 `version = 1` 或任何非节(section)开头的元数据键值对。
适用环境:llama.cpp 版本 8931(commit 9725a313b),Ubuntu 26.04 LTS,NVIDIA GeForce RTX 4090(VRAM 24079 MiB),CUDA 已启用。服务器以路由模式(router mode)启动并指定 `–models-preset`。
最快修复方案:移除 INI 配置文件顶部的 `version = 1` 行(如果它独立在第一个节之前出现)。注意:如果 INI 文件中没有其他全局元数据,直接删除该行即可消除多余的“default”模型。
注意事项:该方案为临时绕开手段,不会破坏正常功能,因为 `version` 键实际上被解析器忽略,删除后与预期行为一致。根本性修复请关注 PR #22741,等待合并到主分支。
问题场景
用户使用 `llama-server` 的路由模式(router mode),通过 `–models-preset` 加载一个自定义 INI 配置文件,文件中定义了多个模型节(section),但在 INI 文件顶部、第一个节之前写有 `version = 1` 这一行。启动服务器后通过 API 查询模型列表时,发现多出一个名为“default”的模型条目,该条目并未在配置文件中定义。
报错原文
Misc. bug: llama-server --models-preset creates an unexpected "default" model entry
(启动日志显示“Loaded 3 custom model presets”,实际只有两个预设,多余的一个为“default”)
原因分析
解析器在读取 INI 文件时,会在遇到第一个节(section)之前,默认将一个未命名的全局区域视为名为“default”的隐式节(与 `common/preset.h` 中 `COMMON_PRESET_DEFAULT_NAME` 一致)。当 `version = 1` 作为键值对出现在文件顶部且不属于任何节时,它被分配到该隐式“default”节中。随后解析器发现 `version` 是元数据键并跳过它,使得该节内没有任何有效配置,但该空节仍被视为一个自定义预设并最终暴露在 `/models` 端点上。根本原因是解析器未正确处理仅包含元数据键的隐式默认节。
环境排查
- 确认 `llama-server` 版本是否 ≤ 8931(或当前 master 分支的提交 bbeb89d76),此版本包含该 bug。
- 检查 INI 配置文件顶部是否有 `version = 1` 或其他不属于任何节的键值对(空行不属于节)。
- 查看启动日志中显示的加载预设数量:若比实际预设数量多一个,且多出的名为“default”,则可确认命中此问题。
解决步骤
- 备份当前 INI 文件。
- 编辑配置文件,将顶部的 `version = 1` 行(包括其后的空行)删除。
- 保存文件并重启 `llama-server`,使用相同的启动参数。
- 若之后需要版本标识,可将其移到某个节内(例如放在 `[meta]` 节下),但通常该键并非必须。
验证方法
执行 `curl http://127.0.0.1:8080/models`(端口以实际配置为准),检查返回的 JSON 中是否仍包含 `”id”: “default”` 的条目。若仅剩下配置文件内实际定义的模型(如 `qwen3.6-27b`、`qwen3-asr-1.7b` 等),则问题解决。同时观察启动日志:应显示“Loaded 2 custom model presets”(与
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。
![Eval bug: [SYCL] garbled output using Qwen3.6-35B-A3B-UD-Q4_K_M using last docker image](https://www.chat-gpts.plus/wp-content/uploads/2026/07/25708-165639ed-768x403.jpg)
![[Bug]: OffloadingConnector corrupts outputs with per-token-head quantized KV cache (cross-layer allocation lacks scale packing)](https://www.chat-gpts.plus/wp-content/uploads/2026/07/48412-9800d6c7-768x403.jpg)
