在旧安卓手机上运行个人AI agent,而非使用服务器

有开发者提出用旧安卓手机替代服务器来运行个人 AI agent,强调“免解锁、免 App、随身携带”的本地化使用方式,该话题在 Hacker News 引发讨论,但也被部分评论者称作“AI 垃圾博客文”。

有开发者提出用旧安卓手机替代服务器来运行个人 AI agent,强调“免解锁、免 App、随身携带”的本地化使用方式,该话题在 Hacker News 引发讨论,但也被部分评论者称作“AI 垃圾博客文”。

KV 缓存是制约大模型推理成本与速度的关键因素,本文梳理了业界减少 KV 缓存占用的 12 种工程技术,覆盖模型架构改动、量化压缩到推理引擎调度优化,为开发者在显存、速度和效果之间做取舍提供了完整参照。

GPT-6 Astra 在重置额度后迎来一批实测,用户在硬件改造、3D 制作、PPT 生成和自动剪辑等场景中验证了其 computer use(电脑自动化)能力的稳定性。实测表明,新模型在处理跨应用、多步骤任务时成功率明显提升,但推理强度 UI 设计引发吐槽。

一篇万字长文梳理了2022年以来AI大模型从闭源黑盒走向开放下载的完整脉络,核心判断是:模型发布时“开放了什么”——网页Demo、API、权重还是训练代码,决定了技术真正惠及普通人的程度,而中国开源模型在其中已占据关键位置。

AI 实践者 Miles 系统梳理了在 Codex 中用 AI 辅助制作 PPT 的完整工作流,覆盖 Slidev、Marp 和归藏社区 Skill 三条主流路线。此事值得关注,因为它展示了大模型从“写文案”延伸到“排版交付”的实际路径,也标出了 AI 生成演示文件当前的边界——尤其是可编辑性与复杂设计仍受限…

本周值得关注的两篇 AI 论文分别从“降低长上下文推理成本”和“让编程智能体长期自主运行”两个方向提出新方案,前者让模型自己决定读取哪些缓存,后者用多角色循环把零散任务组织成可持续数天的开发流程。

OpenAI 首次以官方口径确认,其内部研究组织中“AI 智能体(agent)运行时长”已达到人类工时的 3.1 倍,并宣称达成“自动化研究实习生”里程碑。这意味着AI不再只是辅助工具,而是开始以平行劳动力的形态,深度嵌入前沿实验室的日常研发流程。

Anthropic 用多智能体系统在 11 天内完成了费马大定理的形式化证明,生成 1300 万行 Lean 代码。帝国理工数学家 Kevin Buzzard 承认被 AI“抢先”,但他同时指出,这并未给数学带来新认知,真正的信号是 AI 协作基础设施的成熟。

肯尼亚曾把大学生毕业生的就业希望押注在在线外包与代写产业上,但 ChatGPT 的发布让这条就业通道在两年内几乎塌缩,暴露出生成式 AI 对“数字劳务出口”模式的系统性替代风险。

欧盟科技事务主管 Henna Virkkunen 在 G20 部长级会议上表示,美国最终会走上 AI 监管之路,只是路径不同:欧洲靠事前立法,美国靠法院判例和州级法律。她做出这一表态的场合,恰逢美国发布主张“不新建 AI 监管规则”的《卡罗来纳原则》。