模型越来越强之后,Infra 将被 AI 接管?

模型架构(MoE、全模态)的快速膨胀,正在倒逼 AI 基础设施(Infra)从“可用”走向“高效可规模化”,而国产算力的普及使异构管理成为必答题。多位一线专家认为,未来 Infra 工程师的角色可能从“手写代码”转向“定义 SLA,让模型自己完成任务”。

模型架构(MoE、全模态)的快速膨胀,正在倒逼 AI 基础设施(Infra)从“可用”走向“高效可规模化”,而国产算力的普及使异构管理成为必答题。多位一线专家认为,未来 Infra 工程师的角色可能从“手写代码”转向“定义 SLA,让模型自己完成任务”。

研究者发布了一个名为OpenReviewer的大语言模型(LLM),专门用于自动生成针对科学论文的批判性评审意见。该模型旨在帮助审稿人、作者和期刊编辑部更高效地识别论文中的缺陷与不足,有望改变学术同行评议的工作流程。

OpenAI 发布了 Codex Security CLI 的早期开源版本,这是一个专门用于代码仓库安全扫描、修复验证和 CI/CD 集成的命令行工具,直接瞄准了 AI 辅助开发中最容易被忽视的安全环节。

吴恩达(Andrew Ng)于2026年创立AI教育公司LearnVector,获得Coursera 1亿美元战略投资,目标是用AI为每位学习者打造一对一的个性化学习体验,首批产品预计在2027年初面世。这件事之所以值得关注,是因为吴恩达试图用AI解决教育领域最根本的经济学限制——让“一对一教学”从奢侈品变为…

一篇来自 Hacker News 的热门论文提出了一种名为 “Transformer Transformer” 的统一模型,能够同时优化机器人的外形设计与运动控制。这项工作的潜在影响是降低定制机器人的设计门槛,甚至可能让通用人形机器人的效率优势不再成立。

Fish Audio 在周年庆发布了生产级实时对话语音模型 S2.1Pro,首帧延迟低至 90 毫秒,支持通过文字指令控制耳语、紧张笑声等情绪,并可用 10–30 秒音频完成高质量语音克隆。这标志着语音 AI 正从“读稿式”TTS 转向真正可商用的实时交互对话。

周鸿祎发布企业智能体工作平台“纳米Work”,并喊出“企业搞AI,老板要先用”的口号,360 将为 1000 家小企业提供试用额度与陪跑服务,推动 AI 从口号进入真实业务场景。

数据安全公司 Cyera 宣布以约 10 亿美元收购专注非人类身份(主要是 AI Agent)安全的 Oasis Security。这笔交易表明,随着企业大规模部署 AI Agent,如何管理这些自动程序的权限和行为已成为网络安全领域的核心刚需。

开源项目 Deltafin 用混合计算方案,让一台 64GB M1 Max 工作站本地运行 2.8 万亿参数的 Kimi K3 MoE 大模型,推理速度仅为 0.0687 token/s(约 14.6 秒生成一个 token)。虽然速度极慢,但它证明了“模型远超硬件”的本地推理路径可行。

印度德里高等法院裁定,OpenAI 使用新闻机构 ANI 的内容训练大模型属于“合理使用”,不构成版权侵权。法院同时拒绝了 ANI 要求临时禁令的申请,认为禁令将扼杀印度本土大语言模型的发展。