LiteLLM “Budget has been exceeded!” error is translated to “Bad Request”

用户在 Docker 环境中运行 Open WebUI (v0.3.21) 和 LiteLLM (1.46.1)。用户通过 Open WebUI 将 LiteLLM 配置为 OpenAI 兼容端点,并在 LiteLLM 中设置了用户预算限制。当用户的查询导致成本超过预算时,LiteLLM 会返回详细

用户在 Docker 环境中运行 Open WebUI (v0.3.21) 和 LiteLLM (1.46.1)。用户通过 Open WebUI 将 LiteLLM 配置为 OpenAI 兼容端点,并在 LiteLLM 中设置了用户预算限制。当用户的查询导致成本超过预算时,LiteLLM 会返回详细

用户使用 Pip 安装 Open WebUI v0.10.2,在 Ubuntu 24.04 上启动服务时,因环境变量 CORS_ALLOW_ORIGIN 被设置为空字符串而崩溃。Issue 中用户试图通过空字符串来 禁用 CORS(即不发送 CORS 头),但该用法不受支持。

用户在运行 Open WebUI 时,计划使用远程 Ollama 服务器进行推理,希望本地 Open WebUI 安装保持轻量,不安装 CUDA、Torch 以及完整 Ollama 相关依赖包(如 PyTorch 等大型机器学习库)。

2026年7月19日,面壁智能发布并开源具身智能模型系列MiniCPM-Robot,包含操作模型RobotManip(1.5B参数)和跟踪模型RobotTrack(0.9B参数),同时推出面向物理AI的低时延推理框架PhyAI。这标志着多模态大模型不再止于“回答”,而是开始直接驱动机械臂和移动平台完成连续动作…

摩尔线程不仅完成了从预训练到强化学习的全流程国产GPU大模型训练,其支持的5D世界模型EvoPhys-World更在斯坦福大学评测中获得第一。这标志着国产GPU的竞争,正从堆砌硬件参数转向比拼“生产高质量Token”的系统能力。

中国AI公司月之暗面(Moonshot AI)发布了Kimi K3 open-weight模型,其核心策略是通过强化“记忆”能力降低对算力的依赖,这一技术路线在目前中国大模型竞赛中较为独特,值得关注它对长文本处理场景和推理成本的直接影响。

上海科学智能研究院(上智院)正式发布并开放了科学多模态基础模型“神珍”(MKB),该模型以110亿参数统一处理DNA、RNA、蛋白质、小分子、气象和医学影像六类科学数据,在多项评测中展现了与万亿参数级模型竞争的实力,并同步提供了完整的开源代码、权重及部署文档。

在中国国务院新闻办公室举行的发布会上,工信部公布了2026年上半年软件与开源生态的关键数据:中国AI开源大模型全球累计下载突破100亿次,OpenHarmony生态设备数已超过13.5亿台。这组数据首次以官方口径量化了中国开源软件从“能用”到“被大规模使用”的跨越。

2025年7月18日,GMI Cloud与InfoQ及火山引擎、快手、商汤科技等十余家企业联合发布《中国AI产业核心要素出海发展白皮书》,首次以算力、Token、出海三要素为框架,系统梳理中国AI企业全球化面临的算力溢价、Token通胀与合规壁垒,并提供协同出海的行动指南。

2026年AICon深圳大会将聚焦从模型能力到智能系统的工程化落地,去哪儿网技术负责人李佳奇将分享企业级Agent工程化实践,揭示当前AI落地的核心瓶颈已从模型能力转向“Harness工程”——即如何让Agent安全、可控、可观测地连接真实业务系统。