[Bug]: LM Studio not working with LiteLLM Proxy
![[Bug]: LM Studio not working with LiteLLM Proxy](https://www.chat-gpts.plus/wp-content/uploads/2026/07/11733-211b5be4-768x403.jpg)
该报错发生在使用 LiteLLM Proxy 转发请求到仅提供同步 OpenAI 兼容端点的本地模型(如 LM Studio)时,LiteLLM Proxy 默认使用异步请求导致连接失败。优先排查 LiteLLM Proxy 配置中的 api_base 路径是否完整,以及 Docker 环境下的网络
![[Bug]: LM Studio not working with LiteLLM Proxy](https://www.chat-gpts.plus/wp-content/uploads/2026/07/11733-211b5be4-768x403.jpg)
该报错发生在使用 LiteLLM Proxy 转发请求到仅提供同步 OpenAI 兼容端点的本地模型(如 LM Studio)时,LiteLLM Proxy 默认使用异步请求导致连接失败。优先排查 LiteLLM Proxy 配置中的 api_base 路径是否完整,以及 Docker 环境下的网络

身份管理巨头 Okta 以约 2 亿美元现金收购 AI 安全初创公司 Permiso Security,重点解决 AI Agent 和机器身份的实时威胁检测问题。这笔交易说明,企业在大规模部署自主 AI 应用后,“非人类身份”安全已经成为下一个关键战场。

曾因高调营销引发争议的 AI 硬件公司 Friend,近日重新推出其 AI 项链吊坠,新增了扬声器以实现双向语音对话,但价格从 129 美元翻倍至 249 美元,同时每月额外收取 10 美元的订阅费以延长记忆功能。这一激进定价策略再次引发市场对其产品定位和商业化能力的质疑。

一位资深技术负责人(TL)在2026年亲历AI编码Agent(如基于大模型的Coding Agent)质量跃升后,选择从微观管理代码转变成工程经理(EM)角色,不再紧盯AI写代码,而是把精力放在方案制定与结果验收上。这个案例揭示了AI辅助编程进入“结果导向”的新阶段,并对开发者角色分工与技术选型逻辑产生直接冲…

Google DeepMind 于 2026 年 7 月 30 日发布 Gemini Robotics 2 系列,包含三个新模型,将视觉‑语言‑动作能力融合进人形机器人,实现全身控制和精细操作,并支持多机器人协作。这意味着物理 AI 从桌面任务走向真实场景,机器人“通用大脑”雏形初现。

RadixArk 与 Google Cloud 宣布合作,将开源推理框架 SGLang 的完整功能带到 Google TPU 上,开发者未来可像使用 GPU 一样,用同一套 API 在 TPU 上运行主流大模型,并有望实现新模型“GPU 发布当天即支持 TPU”。

GitHub 为 Copilot 远程控制功能新增企业级策略,管理员可限制仅受管设备(MDM 或文件配置)才能发起远程协助会话,同时支持 SSO 强制授权。这意味着企业可以在不牺牲协作效率的前提下,对 Copilot 的远程访问权限进行更细粒度的安全管控。

Google DeepMind 于 2026 年 7 月 30 日发布 Gemini Robotics ER 2 模型,这是一个用于机器人的“高级大脑”,具备实时视频理解、多步骤任务编排和多机器人协作能力,现已通过 Gemini API 和 Google AI Studio 向开发者开放。

GitHub Copilot 在 Visual Studio 2026 年 7 月更新中推出基于 Copilot SDK 的新 Agent(公开预览)、内置 .NET 和 Azure 专家技能、支持选中代码审查,并允许组织级自定义指令,进一步将 AI 编程助手从“补全代码”升级为“可配置的智能代理工作流”。

企业AI的竞争焦点正从“拥有多少GPU”转向“用好了多少GPU”。Hugging Face博客一篇分析指出,GPU利用率正在成为类似航空业飞机利用率的决定性指标——闲置GPU如同停飞的飞机,成本每天在产生但收益为零,决定AI项目盈亏的已不是算力总量,而是算力实际被调用的比例。