llama-ui : unable to open reasoning level selection menu on desktop

该问题通常出现在单模型模式(非 router 模式)的 llama-server WebUI(llama-ui)中:桌面宽度(>= 768px)下推理等级选择菜单不再显示,而移动端宽度(<= 767px)仍可见。优先排查是否是 PR #27746 引入的桌面端渲染回归,并确认是否已有修复 PR #2
先解决问题,再了解资讯。选择你现在要完成的任务。

该问题通常出现在单模型模式(非 router 模式)的 llama-server WebUI(llama-ui)中:桌面宽度(>= 768px)下推理等级选择菜单不再显示,而移动端宽度(<= 767px)仍可见。优先排查是否是 PR #27746 引入的桌面端渲染回归,并确认是否已有修复 PR #2

OpenAI 于 9 月 17 日发布法律领域专用 AI 平台 Astra for Law,其法律检索索引覆盖超 2.3 亿个 URL,在 Vals AI 法律研究基准的 200 道美国法律题上取得 54.0% 的准确率,比仅靠网页搜索的 GPT-6Astra 高出 15 个百分点以上。这是 OpenAI 从…

Figure 发布人形机器人神经网络 Helix2.5,靠 Index 人类行为数据集预训练,在 30 户从未采集过的旧金山湾区家庭里把零样本任务成功率从 9% 提到 56%。这说明人形机器人的泛化能力,可能正从“逐户调参”转向“预训练底座 + 少量适配”。

Anthropic 内部数据显示,Claude 已写下公司约八成代码,工程师季度代码交付量达到 2021 至 2025 年平均水平的 8 倍,但由此引发的 CI 任务量半年内暴涨 25 倍,几乎压垮持续集成系统。

Anthropic 重构了 Claude Code 的项目功能,加入多线程并行协作机制:用户只需描述项目目标,协调器会把任务拆分给多个独立“线程”,各自在云端会话中运行并可单独提交 PR、跑测试。这使 Claude Code 从单个 AI 编程助手,向多智能体协作平台演进。

Anthropic 推出生命科学认证计划,把 Mythos 5.1、Opus 5、Sonnet 5 三款主力模型统一纳入生命科学场景的授权条款,为药企、生物科技公司和科研机构划出明确的使用边界与合规路径。

这个报错通常出现在 Dify 通过 Agent 调用 MCP 工具、且工具返回的是紧凑 JSON 对象时。日志或工具调用历史里会出现两份内容相同、格式不同的对象(一份紧凑、一份格式化),优先排查 ToolEngine.tool_response_to_str 的字符串去重逻辑。

在 ROCm 上启用 VLLM_USE_BREAKABLE_CUDAGRAPH=1 后,引擎启动阶段会把 compilation_config.custom_ops 解析为包含 'all' ,从而启用 sparse_attn_indexer_kpool ;AMD 实现只定义了 forward_nat

这个报错通常出现在 vLLM 的 MoE 权重加载路径读取 moe_config.tp_shard_with_padding 时,测试桩中的 SimpleNamespace 配置没有定义该属性。优先排查测试/调用方传入的 MoE 配置是否包含 tp_shard_with_padding ,它与 pa

TypeSafe AI 发布了大模型 Jev,它不追求通用对话能力,而是专攻高频分类与判断类决策任务,作者实测后认为其性价比值得关注。这代表大模型正在从"什么都能聊"转向"在特定环节把成本和准确率压到极致"。