Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型

开源工具 Soup 推出了 v0.72.4 版本,让开发者在 4GB 显存的笔记本 GPU 上也能微调 8B 参数大模型,并新支持了 DPO、ORPO 等偏好对齐训练。它用"层流式加载"技术把显存占用压到 3.32GB,大幅降低了消费级硬件做 LLM 微调的门槛。

开源工具 Soup 推出了 v0.72.4 版本,让开发者在 4GB 显存的笔记本 GPU 上也能微调 8B 参数大模型,并新支持了 DPO、ORPO 等偏好对齐训练。它用"层流式加载"技术把显存占用压到 3.32GB,大幅降低了消费级硬件做 LLM 微调的门槛。

这个报错通常发生在用 LlamaIndex 加载一个“不是由 LlamaIndex 创建”的既有 Weaviate 向量库时,Weaviate 返回的对象缺少 LlamaIndex 解析 Node 所需的元数据字段(如 id 、 _node_content ),导致查询阶段抛出 ValueError

让 AI 智能体免人工审核自动合并代码的关键,不是更强的模型,而是一道「有证据、有规则」的评测闸门——前提是评测系统本身得先解决偏差问题。

MiniMax 发布的全模态生成系统 MiniMax-H3 被第三方开发者移植到了苹果 MLX 框架,Mac 用户可以在本地生成最长 15 秒、带音频的视频片段。这个移植意味着视频生成模型的运行门槛首次被拉低到个人桌面设备。

GitHub 法务团队的非工程师成员用 Copilot CLI 搭建了合同起草和版权通知分析等内部工具,将重复性法律工作的审阅和起草时间缩短约一半。这件事说明,用自然语言驱动 AI 构建工具的门槛已显著降低,非技术岗位也能直接参与 AI 应用开发。

GitHub 已停用 Copilot Billing Preview 应用,Copilot 用量与费用管理全部收口到 GitHub 账单设置中。这意味着 Copilot 从“按预览应用查账”进入“平台原生计费管理”阶段,企业用户需要尽快切换管理路径。

GitHub 发布了新的仓库属性 github-codeql-config-file ,让团队可以在代码扫描默认设置中统一挂载自定义 CodeQL 配置文件,既保留默认设置的低维护优势,又能像高级设置一样精细化控制扫描范围与规则,面向大规模组织治理场景。
![[Agent v2]pydantic_core._pydantic_core.ValidationError: 3 validation errors for AgentSoulConfig](https://www.chat-gpts.plus/wp-content/uploads/2026/08/38354-97620399-768x403.jpg)
该报错通常出现在 Dify 自托管源码部署中打开或加载 Agent v2(Agent Composer)时,API 服务在解析 AgentSoulConfig 配置时触发 pydantic 校验失败,抛出 [Agent v2]pydantic_core._pydantic_core.Validati

一项覆盖60个语言模型基准的系统研究显示,近一半基准已趋饱和,越来越难区分不同模型的真实水平;而能延长基准寿命的关键不是公开测试数据,而是专家的人工策展设计。

开源数据库 MariaDB 提交了一个 PR,打算在客户端提示和服务器日志里加入“请帮我们到 GitHub 点星”的推广文案,目标是让星标数突破 10k 并超过 MySQL。这个想法引发了社区激烈争论。