我用手上这台笔记本实测了本地 LLM

一位开发者用自己的 2021 款 M1 Pro 16GB 笔记本实测了五款主流开源小模型,发现这一代模型确实比一年前聪明不少,但“先思考后回答”的推理机制让本地运行慢到需要一两个小时,算力门槛比网上讨论的残酷得多。

一位开发者用自己的 2021 款 M1 Pro 16GB 笔记本实测了五款主流开源小模型,发现这一代模型确实比一年前聪明不少,但“先思考后回答”的推理机制让本地运行慢到需要一两个小时,算力门槛比网上讨论的残酷得多。

OpenAI正在招聘一位电力交易负责人,把电力采购从“交电费”升级为“管理大宗商品仓位”。这意味着AI算力扩张的核心瓶颈已经从芯片转移到了电力,而大模型公司开始用金融手段来对冲电价波动。

Point2 Technology 完成 1.36 亿美元 B 轮融资,其 e-Tube 射频电缆声称比铜缆传输距离远 10 倍,比光模块功耗低 3 倍、延迟低 1000 倍,正在试图成为 AI 数据中心内部互连的新标准。Nvidia、Arm、Molex 等产业链公司同时押注,意味着“线缆”已成为 AI 算力…

Cactus 发布新一代端侧智能体模型 Needle 2,仅 14MB、45M 参数,就能在树莓派、千元机和 VR 头显上完成工具调用和结构化输出。它把“边缘 AI”从 Mac/PC 拉回到更庞大的低算力设备市场,并证明特定任务并不需要大模型。

Meta CEO 马克·扎克伯格于 2026 年 8 月 10 日发布了一篇 6500 字的个人 AI 宣言,描绘“人人拥有超级智能”的乐观前景。但文章发布后引发反效果——社交媒体时代积累的不信任,加上对 AI 实际滥用场景的回避,反而让大众更警惕 AI。

这一轮由 AI 技术爆发的财富增长,重新引发了对“私人权力”的讨论——话题不是 AI 产品本身,而是资金高度集中在少数科技领袖手中,以及他们通过慈善、投资和公司控制权所获得的公共影响力,是否已经超出了合理边界。

Floatboat 用市面上最便宜的模型 DeepSeek-V4-Flash 作底座,在五项第三方 Agent 基准上全部超过价格贵 57.1 倍的 Claude Opus 4.8。它想证明:Agent 的胜负手不只是模型,而是模型之外那半套系统——Harness。

摩根大通本周一将标普500年末目标价从7800点上调至8000点,理由是AI资本开支的回报终于“越来越可见”——这意味着华尔街开始相信,科技巨头砸下的千亿美元算力投入,正在变成真实的收入和利润,而不是无底洞。

Hugging Face 与 EleutherAI 合作发起 FineBooks 项目,实测 14 款开源 OCR 模型后发现,当前最优模型能以不到每千页 2 美元的成本,把历史书籍扫描文本的字符准确率提升到 97% 以上,足以改善大模型训练数据的质量,但也还不能直接用于学术研究。

原定发布的《AI音乐周刊 W.A 040》因原文链接访问超时,本期具体资讯内容未能获取。但该周刊持续更新至第 40 期本身,已反映出 AI 音乐生成领域近一年来信息密度和产品迭代频率明显加快。