上海AI Lab与上交大抛出NCP预训练新范式,8.9B隐空间模型用一半Token追平对手

上海AI Lab与上海交大LUMIA Lab提出"下一概念预测"(NCP)预训练任务,发布8.9B参数的离散隐空间基座模型NCP-ArchPreview,用约一半Token预算追平OLMo-3-7B的预训练Loss,收敛速度提升1.95倍。

上海AI Lab与上海交大LUMIA Lab提出"下一概念预测"(NCP)预训练任务,发布8.9B参数的离散隐空间基座模型NCP-ArchPreview,用约一半Token预算追平OLMo-3-7B的预训练Loss,收敛速度提升1.95倍。

SpaceXAI 于 9 月 21 日发布 Grok 4.7,官方称推理速度达到同类模型的两倍,价格降至竞争对手的一半,输入每百万 Token 仅 2 美元。速度与成本同时下探,直接冲击当前大模型 API 的性价比基准。

在 2026 云栖大会上,阿里宣布下一代架构的 Qwen4 已进入训练,并公开了向 5000 亿至 1 万亿参数、乃至 10 万亿参数演进的路线图,同时披露大模型递归自我改进(RSI)已落地到训练、推理和芯片协同环节。

宇树科技发布全新 Dex5-S 灵巧手,单手 22 个自由度、售价 3.99 万元起,并同步推出 Pro 版。这意味着一只接近人手尺寸和灵活度的高性能机械手,开始以相对可负担的价格进入市场。

2026 年上半年全球 AI 眼镜出货量同比增长 263%,其中不带 AR 显示的“无屏幕”产品贡献了绝大部分销量,而以 Rokid、Meta 为代表的带显示产品增速更高但基数仍小。这一分化说明 AI 眼镜正先以“音频+AI 助手”的轻形态进入大众市场。

GitHub 于 2026 年 9 月 21 日宣布,全新的仓库 pull requests 页面正式对所有用户开放,带来内容辅助筛选、高级搜索、可折叠侧边栏和紧凑视图等能力,让代码审查的发现与处理效率明显提升。

这个报错通常出现在使用 TimmBackbone 并把 timm 模型当骨干网络(如 Mask2Former、ViT 等)时,旧版 Transformers 会强制读取被包装模型的 return_layers 属性,而 timm 新引入的 FeatureGetterNet 并没有该属性。优先排查 T

这个报错通常出现在尝试把 CLIP 模型导出到 ExecuTorch 时,旧版代码因 linalg_vector_norm 算子不被 ExecuTorch 支持而导出失败。优先确认 transformers 版本是否已包含已分解的 norm 实现,以及导出器是否已迁移到 transformers.e

这个报错通常出现在你想用 Hugging Face Transformers 微调 CLIPSegForImageSegmentation 时,因为官方缺少微调脚本和数据集准备说明,容易在构造 labels 时传入错误类型或形状,触发 Finetune ClipSeg model 相关问题。优先确认

这个报错通常发生在自托管 n8n 升级到 stable 分支的 2.39.8 后,通过 API 或 Action 删除证书/凭据时被后端拒绝。优先排查 n8n 版本,升级到包含修复的 2.39.9 及以上版本。