[Bug]: DashScope tiered pricing uses graduated slices instead of the request-size tier
![[Bug]: DashScope tiered pricing uses graduated slices instead of the request-size tier](https://www.chat-gpts.plus/wp-content/uploads/2026/08/34729-a68deaea-768x403.jpg)
该报错发生在 LiteLLM 的 DashScope 成本计算器将阶梯定价按“超额累进”方式分段计费,而阿里云 Model Studio(百炼)实际是按单次请求的总输入 token 数选择唯一档位、整单统一计价。优先检查你使用的 LiteLLM 版本是否已包含 #36720 修复。
![[Bug]: DashScope tiered pricing uses graduated slices instead of the request-size tier](https://www.chat-gpts.plus/wp-content/uploads/2026/08/34729-a68deaea-768x403.jpg)
该报错发生在 LiteLLM 的 DashScope 成本计算器将阶梯定价按“超额累进”方式分段计费,而阿里云 Model Studio(百炼)实际是按单次请求的总输入 token 数选择唯一档位、整单统一计价。优先检查你使用的 LiteLLM 版本是否已包含 #36720 修复。
![[Bug]: Nullable DailyTagSpend conflict columns cause duplicate inserts and database CPU exhaustion](https://www.chat-gpts.plus/wp-content/uploads/2026/08/34232-5fa4edae-768x403.jpg)
该报错通常出现在 LiteLLM 代理使用 PostgreSQL 存储每日标签消费(DailyTagSpend)数据时,由于数据库唯一约束中的可空列(如 custom_llm_provider)在 upsert 时写入 NULL,导致同一逻辑键产生大量重复物理行,最终引发数据库 CPU 耗尽和消费报

ChatGPT 面向订阅用户开放了 Google Drive 文件的直接导入与编辑能力,用户不必再在 AI 对话框和云盘之间反复切换;同时新增测验工具和 Yelp 餐厅预订整合,AI 应用正从“聊天”走向“办事”。

DeepSeek 自 8 月 17 日起对 API 实行峰谷计费,高峰时段调用价格为闲时两倍,同时 V4Pro 全面提价,缓存命中输入价格涨幅高达 1100%。这是 DeepSeek 从“极致性价比”转向精细化算力运营的重要信号。

支付巨头 Stripe 据传将以超过 70 亿美元收购 AI 模型聚合网关 OpenRouter。如果成行,这将是 AI 基础设施领域最大规模的并购之一,意味着支付公司开始直接切入 AI 应用分发层。

Netflix 公开了其内部 LLM 推理服务平台的设计细节——用 Triton 负责模型管理与调度、vLLM 负责 GPU 上的推理执行,并解决了版本兼容、约束解码状态同步等生产级问题。这件事的参考价值在于,它展示了一套面向大规模业务场景的 LLM 服务架构,不是简单调用 API,而是把推理基建做成可演进的…

Dropbox 将内部知识检索系统 Dash 通过 MCP 协议接入代码审查流程,让安全设计文档在工程师评估 Pull Request 时自动浮现。这件事值得关注,因为它展示了大模型在企业落地的另一种路径:不是替代人做判断,而是把组织已有的知识在正确的时间点交给正确的人。

安徽农业大学团队发布大豆领域垂直大模型“丰菽”2.0,通过多模型协同机制降低单一大模型的“幻觉”偏差,把基因组、表型、文献等数据整合成可用的育种知识服务,是农业垂直大模型从“能问答”走向“能辅助决策”的一次落地。

SpaceX 以约 600 亿美元完成对 AI 编程工具公司 Cursor 的收购,这是今年目前规模最大的并购案。Cursor 将借助 SpaceX 的 GPU 算力集群加速大模型训练,双方合作的第一个成果是近期发布的 Grok 4.6。

在8月17日结束的第32届全国大豆研究生产研讨会上,王晓波教授团队正式发布大豆垂直大模型「丰菽」2.0。这一版本整合多模态数据和专业文献,引入多模型协同机制,为大豆育种数据化与知识服务提供了新的AI基座。