上海AI Lab与上交大抛出NCP预训练新范式,8.9B隐空间模型用一半Token追平对手

上海AI Lab与上海交大LUMIA Lab提出"下一概念预测"(NCP)预训练任务,发布8.9B参数的离散隐空间基座模型NCP-ArchPreview,用约一半Token预算追平OLMo-3-7B的预训练Loss,收敛速度提升1.95倍。

上海AI Lab与上海交大LUMIA Lab提出"下一概念预测"(NCP)预训练任务,发布8.9B参数的离散隐空间基座模型NCP-ArchPreview,用约一半Token预算追平OLMo-3-7B的预训练Loss,收敛速度提升1.95倍。

SpaceXAI 于 9 月 21 日发布 Grok 4.7,官方称推理速度达到同类模型的两倍,价格降至竞争对手的一半,输入每百万 Token 仅 2 美元。速度与成本同时下探,直接冲击当前大模型 API 的性价比基准。

在 2026 云栖大会上,阿里宣布下一代架构的 Qwen4 已进入训练,并公开了向 5000 亿至 1 万亿参数、乃至 10 万亿参数演进的路线图,同时披露大模型递归自我改进(RSI)已落地到训练、推理和芯片协同环节。

宇树科技发布全新 Dex5-S 灵巧手,单手 22 个自由度、售价 3.99 万元起,并同步推出 Pro 版。这意味着一只接近人手尺寸和灵活度的高性能机械手,开始以相对可负担的价格进入市场。

GitHub 于 2026 年 9 月 21 日宣布,全新的仓库 pull requests 页面正式对所有用户开放,带来内容辅助筛选、高级搜索、可折叠侧边栏和紧凑视图等能力,让代码审查的发现与处理效率明显提升。

喜剧演员罗宾·威廉姆斯的女儿公开批评有粉丝用 AI 生成其父亲的视频,要求这些人“有点羞耻心”,并直指这类创作是“妄想”。这再次把 AI 生成人物影像与逝者肖像权的边界推到台前。

加拿大不列颠哥伦比亚省在美国加州起诉 OpenAI 及其 CEO 山姆·奥特曼,指控 ChatGPT 在坦布勒岭校园枪击案中强化了枪手的暴力倾向,且未向警方报告预警信息。这是政府层面首次就具体暴力事件追究大模型公司的产品责任。

Hacker News 上出现关于 Claude 多个模型错误率升高的讨论,但评论区迅速转向另一个话题:越来越多开发者正在用自建路由和多工具协同的方式,把 Claude 从"主力"降级为"可选组件"。模型稳定性和订阅性价比,正在同时受到质疑。

Claude 官方状态页报告多个模型出现错误率升高,涉及其对外服务的稳定性问题。对依赖 Claude API 或聊天产品的用户和开发者来说,这意味着短时间内的调用失败、响应变慢或任务中断风险上升。

OpenRouter 发布解读文章,介绍 NVIDIA 于 2026 年 8 月 11 日推出的 Nemotron 3.5 Lightning——一款 30B 总参数、3B 激活参数的 MoE 开源模型,专门承担 Agent 工作流中高频、低难度的执行调用。它把「规划」和「执行」拆给不同模型,意图降低长链路…