Show HN: 如何在我的低配置电脑上运行 GLM-5.2

一位开发者展示了一款名为 colibrì 的纯 C 推理引擎,能在只有 25GB 内存的个人电脑上运行 7440 亿参数的 GLM-5.2 混合专家模型。通过将大部分参数存储在磁盘并按需加载,它把原本需要数千美元专业显卡才能运行的模型,压缩到了消费级硬件可用的程度。

一位开发者展示了一款名为 colibrì 的纯 C 推理引擎,能在只有 25GB 内存的个人电脑上运行 7440 亿参数的 GLM-5.2 混合专家模型。通过将大部分参数存储在磁盘并按需加载,它把原本需要数千美元专业显卡才能运行的模型,压缩到了消费级硬件可用的程度。

小红书上"咪咪大军"等创作者利用AI图像生成工具制作超萌小人互动日常系列内容,以极高可爱度和强互动性迅速引发关注,展示了低成本、高情感回报的AI内容创作新范式。

NVIDIA 发布了一套基于 NeMo 框架的迭代式合成数据生成方案,用于解决金融大模型微调中真实数据稀缺、类别失衡的问题。该方案在 6 天内用单台 8 路 B200 节点生成了约 50 万条独特新闻标题,并开源了数据集,有望降低金融 NLP 研究的门槛。

Nemotron Labs 发布了 3 Puzzle 75B A9B 模型,这是一款通过压缩混合专家(MoE)架构优化的大语言模型,能在推理时实现 2.03 倍的服务器吞吐量提升,同时保持高精度。这意味着开发者可以在更少的硬件成本下运行更强的 AI 服务。

爱沙尼亚政府因立法草案中的一个用词疏漏,导致在线博彩行业在一年内逃脱了约 2800 万美元的税收。这一尴尬事件催生了名为“Apsakaleidja”(即“Fuckup Finder”)的 AI 工具用于审查草案,并推动该国加速将 AI 代理引入政府决策与行政流程。

LinkedIn 正被大量 AI 生成的虚假招聘、伪成长帖和刻意的营销内容淹没,用户普遍反馈平台已丧失专业讨论价值,本质上是微软复制 Facebook 增长策略导致的社区质量下降。

上海成立不满两年的创新型教育机构“上海创智学院”,探索以“研创学”一体化模式培养AI顶尖人才,已孵化26家高估值公司、整体估值超40亿元,并迎来首届博士生毕业。这不仅是教育实验,更是中国在AI人才争夺战中给高等教育体制的“压力测试”。

7月9日,粤港澳大湾区首个完全基于国产芯片、用于训练国产大模型的万卡智算集群在广东韶关数据中心集群正式发布。该集群总投资约55亿元,部署了3000个昇腾910C国产超节点,建成9000P(FP16)的统一智算资源池,是目前大湾区规模领先的全国产万卡训练集群。

精准医疗AI公司Tempus AI宣布将于7月30日美股盘后发布2026年第二季度财报,市场分析师对其营收的共识预期约为3.80亿美元,同比增长约20.6%。这一数据将直接检验其在医疗健康AI这一快速增长赛道上的商业化进展。

AI 大幅降低了产品开发门槛,但用户注意力有限,2026年一季度全球新上架 App 数量暴增115%,仅 0.02% 达到高牵引力标准。真正的价值已从“做出来”转移到“为什么是你”。