标签: API

AI 名词小白入门白皮书

AI 名词小白入门白皮书

一份面向非技术读者的《AI名词小白入门白皮书》出现在社区,核心不是罗列术语,而是提出一套分层框架,帮读者判断 GPT、RAG、MCP、Agent 这些词在 AI 系统中各自处于哪一层。它提示我们:背熟名词清单,不如先分清模型、产品、工具和执行机制之间的层级关系。

刚刚,Meta开源了一个30B本地端侧Agent模型:Muse Glimmer,能看屏幕、调工具、失败了会自己重试 从Muse Spark专门针对Agent能力蒸馏出来的,在单张消费级GPU(Mac/ PC)上能跑,无需联网 与同尺寸级的Gemma4-31B、Qwen3.6-27B对比,在智能体、编程、多模态、安全和推理等多个基准上表现强劲 多模态输入(文本+图像),能理解屏幕截图、图表、文档,支持OpenClaw等、100+语言 支…

刚刚,Meta开源了一个30B本地端侧Agent模型:Muse Glimmer,能看屏幕、调工具、失败了会自己重试 从Muse Spark专门针对Agent能力蒸馏出来的,在单张消费级GPU(Mac/ PC)上能跑,无需联网 与同尺寸级的Gemma4-31B、Qwen3.6-27B对比,在智能体、编程、多模态、安全和推理等多个基准上表现强劲 多模态输入(文本+图像),能理解屏幕截图、图表、文档,支持OpenClaw等、100+语言 支…

Meta 开源了一个面向本地端侧 Agent 场景的 30B 参数模型 Muse Glimmer,能在单张消费级 GPU 上离线运行,并宣称在智能体、编程、多模态等多个维度上对标甚至超过同尺寸竞品。这是开源社区在"本地化 Agent 推理"方向上的又一次重量级补给。

Meta 发布的 30B 开源模型 Muse Glimmer 打响了端侧 Agent 的第一枪!🔥 由 Unsloth AI 推出的 2-bit GGUF 量化版本,仅需 14GB RAM 即可流畅运行(轻薄本如 MacBook Air 也无压力): ✅ 支持 Vision 多模态 + 顶级 Agent 能力 ✅ 连续 5 分钟无间断自动代码 Bug 排查 ✅ 独立完成 100+ 次工具调用、漏洞复现、代码修复、编写测试及 PR 文档…

Meta 发布的 30B 开源模型 Muse Glimmer 打响了端侧 Agent 的第一枪!🔥 由 Unsloth AI 推出的 2-bit GGUF 量化版本,仅需 14GB RAM 即可流畅运行(轻薄本如 MacBook Air 也无压力): ✅ 支持 Vision 多模态 + 顶级 Agent 能力 ✅ 连续 5 分钟无间断自动代码 Bug 排查 ✅ 独立完成 100+ 次工具调用、漏洞复现、代码修复、编写测试及 PR 文档…

Meta 开源的 30B 参数多模态模型 Muse Glimmer,被 Unsloth AI 压缩到 2-bit GGUF 量化版本后,只需 14GB 内存就能在轻薄本上运行,并完成了连续 5 分钟、100+ 次工具调用的自主代码排错任务,这意味着端侧 Agent 的门槛正在被拉低。

OpenRouter 推出由市场智慧驱动的新版 Auto 路由器

OpenRouter 推出由市场智慧驱动的新版 Auto 路由器

OpenRouter 上线新版 Auto 路由器,不再按固定规则选模型,而是依据全平台每周 55 万亿 token 的真实调用数据,把“大多数人在同类任务上选什么模型”转化为路由决策。它对知识、搜索、编程等任务的性价比明显改善,开发者可通过 cost_tier 参数平衡成本与质量。

网页版 Copilot 扩展对话控制

网页版 Copilot 扩展对话控制

GitHub 为网页版 Copilot Chat 增加了对话最小化、最近会话恢复和 token 用量提示功能。这不是一次模型能力升级,而是把 AI 编程助手从“一次性问答”推向“可管理的工作流工具”。