这项AI SSD技术让8张RTX 5090在推理时性能相当于46块GPU

GenStorAIGE 在 WAIC 2026 上发布了 AI90 推理加速平台,通过将 SSD 直接纳入显存层级,让 8 块 RTX 5090 在大型语言模型推理中的表现等效于 46 块 GPU 的集群。这一技术突破了传统 GPU HBM 的容量瓶颈,为大规模长上下文推理提供了一条新的低成本路径。

GenStorAIGE 在 WAIC 2026 上发布了 AI90 推理加速平台,通过将 SSD 直接纳入显存层级,让 8 块 RTX 5090 在大型语言模型推理中的表现等效于 46 块 GPU 的集群。这一技术突破了传统 GPU HBM 的容量瓶颈,为大规模长上下文推理提供了一条新的低成本路径。

一位开发者因无法忍受大模型过度模仿人类社交用语(如“好问题!”“让我想想”),编写了一套系统提示让AI回归“工具式”简洁输出,并将该提示开源分享,引发社区对AI交互设计方向的讨论。

围绕Claude 5代模型的讨论,揭示了一个核心矛盾:LLM本质上通过语言进行“思考”和抽象概念编码,但人类思考主要依赖非语言的、多模态的认知过程,语言只是有损的翻译。这一差异正成为模型上下文工程和交互体验设计的关键新规则。

一位日本开发者发布了名为《Yorishiro》的macOS终端应用,为AI智能体(Agent)赋予具有表情和物理环境的3D身体,尝试用视觉反馈替代传统文本对话,重塑人机交互体验。

俄罗斯总统普京在2017年Google发表Transformer架构论文后预言“谁掌握AI谁将统治世界”,如今这一判断随着俄乌冲突中自主武器实战、中美AI军备竞赛白热化而加速兑现。AI领导权已从商业竞争升格为国家战略博弈的核心变量。

AI 研究员 Max Mynter 用 18 个月的系统准备,从一名自学的机器学习工程师成功拿到 Mistral(欧洲顶级大模型实验室)的研究工程师 offer。他详细拆解了战略(长期技能积累与网络建设)和战术(刷题、面试技巧)的配合方法,对想进入头部 LLM 团队的开发者有直接参考价值。

三星在 Galaxy Unpacked 上全面押注 AI 健康,高管宣称“希望让人们远离医生”。但就在同期,一则“不共享数据就删除健康记录”的传言引发用户信任危机,三星随后澄清该说法不实。AI 健康的价值与隐私担忧,正在迎面碰撞。

一位求职者在Hacker News上分享自己应聘大型AI实验室研究工程师的经历,发现offer水平、面试难度与公司知名度之间几乎“无规律可循”,同一求职者获得的最高与最低薪酬报价相差可达3倍。这再次引发了行业内对AI人才市场高度随机性和幸存者偏差的讨论。

独立开发者 Owen Song 发布了 Inflect-Micro-v2,一个仅有 9.36M 参数的端到端文本到语音模型,可在 CPU 上以 6 倍实时速度运行,并在社区盲测中取得 66.2% 的偏好率。它证明了极低参数量也能实现可用的语音合成,为本地化、低算力部署提供了新选择。

美国历史教授Jason Gibson在期中考试中通过一个隐藏提示词(要求无意义使用“Madagascar”),发现35名学生中有32人直接用AI生成答案,且未做任何校对,答案荒谬到将马达加斯加与工业革命强行关联。此事两周内视频播放超千万次,暴露了当前学生群体中大规模使用AI作弊且缺乏基本审慎的现状,也再次引发…