Swiftlet 把 80B 量级 Qwen 巨兽塞进 Mac:峰值内存仅 4.3GB,iPhone 17 还能原生机跑 35B

Swiftlet 是一个专为 Qwen3 系列 MoE 模型打造的 Swift + Metal 运行框架,通过把专家权重放在 SSD 上按需读取,让 80B 级模型在 Mac 上峰值内存仅 4.3GB,并首次实现了 35B 级模型在 iPhone 17 上原生机跑,不再依赖服务器。

Swiftlet 是一个专为 Qwen3 系列 MoE 模型打造的 Swift + Metal 运行框架,通过把专家权重放在 SSD 上按需读取,让 80B 级模型在 Mac 上峰值内存仅 4.3GB,并首次实现了 35B 级模型在 iPhone 17 上原生机跑,不再依赖服务器。

CodeBuddy与WorkBuddy宣布将Hy3大模型的免费体验延长至2026年8月31日,原因是用户反馈热烈。对开发者和办公用户而言,这是一次更长的零成本测试窗口,也反映出工具类产品正在用自研模型加深用户绑定。

亚马逊一名工程师用 Claude 编写的数据处理程序因调用无限制、缺乏监控,5 个月烧掉 180 万美元、超预算 860%,且项目从未上线。它说明 AI 从辅助工具

Palantir CEO Alex Karp在财报电话会上批评前沿AI实验室“想殖民你的企业”,并宣称企业需要“AI主权”来保住数据和竞争优势。这既是对大模型厂商的公开抨击,也是Palantir借财报高增长向企业客户推销自身价值的最新动作。

墨西哥国立自治大学(UNAM)今年首次用AI监考软件举行大规模远程入学考试,结果高分成绩异常暴增、作弊嫌疑严重,约5.8万名考生被要求重新参加线下考试。这一事件说明,AI在线监考技术在高风险大规模考试中,可能既挡不住作弊,也让正常考生承担额外成本。
![[Question]: Agent response only has thinking chain with gray color and no formal answer output.](https://www.chat-gpts.plus/wp-content/uploads/2026/08/10995-75a646ed-768x403.jpg)
该报错([Question]: Agent response only has thinking chain with gray color and no formal answer output.)通常发生在 RAGFlow 的 Agent 工作流运行完成后,界面只显示灰色思考 参考来源 infi

开发者发布了一款名为 PISIGuard 的开源浏览器扩展,能在用户向 ChatGPT、Claude、DeepSeek 等 AI 发送消息前自动识别并脱敏姓名、邮箱、API 密钥等敏感信息,AI 回复后再自动还原,全程在本地完成。在 AI 隐私焦虑日益突出的当下,它提供了一种不依赖 AI 服务商承诺的轻量级保…

Y Combinator 将旗下多人在线 AI 代理工具 QM 以 MIT 许可证开源,支持在 Slack 和 Web 界面中运行。这意味着团队协作式 AI 代理从闭门实验走向开放生态,开发者可以直接获取、修改并部署这套工具。

墨西哥国立自治大学(UNAM)首次用 AI 摄像头监考远程入学考试,结果高分考生比例异常飙升,校方决定让约 5.8 万名考生重新线下考试。这起事件暴露了 AI 监考系统在大规模高利害考试中的可靠性危机。

Anthropic 于 8 月 4 日发布 Claude Code v2.1.221,重点修复了一批涉及命令执行安全、MCP 连接和跨平台兼容性的问题,并新增了 Focus View 等开发体验改进,让 CLI 编程智能体在真实工程环境里更可靠。