直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能

南洋理工大学、商汤研究院和大连理工大学联合发布了原生多模态大模型NEO-ov,完全摒弃传统视觉编码器,让大模型直接从原始像素学习语言。在空间智能等任务上,它甚至超越了依赖编码器的竞品,证明“端到端”路线不仅可行且已具备竞争力。

南洋理工大学、商汤研究院和大连理工大学联合发布了原生多模态大模型NEO-ov,完全摒弃传统视觉编码器,让大模型直接从原始像素学习语言。在空间智能等任务上,它甚至超越了依赖编码器的竞品,证明“端到端”路线不仅可行且已具备竞争力。

Aether AI 提出“因果世界模型”技术路线,让 AI 从单纯预测“接下来发生什么”转向理解“为什么发生”并模拟干预后果,首攻 Physical AI 机器人推理层。这不仅是一次架构创新,更直接挑战了当前大模型依赖统计相关性的固有边界。

截至2026年6月,本地运行AI大模型已从“缓慢且难以使用”的困境中走出,达到了“点两下就能跑”的实用化分水岭。以Gemma 4系列为代表的轻量化模型,结合成熟工具链,让开发者在个人电脑上就能接近前沿模型的编码与智能体任务表现。

软银集团董事长孙正义在股东大会上披露,公司已在某工厂启动面向“物理AI”场景的机器人量产,并计划在2026年完成对瑞士工业巨头ABB旗下机器人业务的收购,目标成为“压倒性世界第一的机器人公司”。这一动作意味着软银正在加速从投资公司转向实体AI硬件制造商。

在2026年MWC上海开幕式上,中国移动董事长陈忠岳宣布公司将构建一体化算力网,布局超大规模智算中心,并提出了从“离身智能”到“内身智能”的智能形态三阶段演进框架。这明确透露出中国移动正从传统通信运营商向AI基础设施服务商转型,其算力网络布局将对AI训练和推理的成本、效率产生直接影响。

高通在2026年6月的汽车技术与合作峰会上,展示多款基于骁龙8775(Flex平台)的量产舱驾融合车型,并推出面向智能体时代的“车端人工智能Claw生态计划”。这意味着高通正从传统的“智能座舱芯片供应商”转向“物理AI基础计算层”的构建者,其技术能力和商业潜力需要被市场重新评估。

追觅科技澄清其汽车业务负责人离职传闻,微信开启原生AI助手“小微”小范围测试,苹果与特斯拉核心供应商塔塔电子遭遇超630GB数据泄露。三者分别反映了跨界AI硬件公司的组织调整、超级App内嵌AI助手的落地进展,以及AI供应链安全面临的现实挑战。

Google DeepMind 的 Gemini 预训练主管 Vlad Feinberg 在一场播客中曝光了模型训练的真实面貌:5 人团队在硅谷和巴黎两地倒班、不眠不休 40 天,才让 Gemini 2.0 上线。与此同时,他指出了当前 AI 行业最稀缺的能力——不是发论文,而是踏实解决算力与工程落地的“脏活…

Meta 因内部安全漏洞,导致用于训练 AI 的员工监控数据(键盘输入、屏幕内容、私人对话及绩效信息)被全公司可见,项目紧急叫停,员工对管理层信任跌至冰点。

2026 年 6 月 8 日,Spring 生态大规模更新:Spring Boot、Security、AMQP 等发布增量版本,Spring AI 2.0 与 Spring Data 2026.0.0 正式推出,同时修复了多项安全漏洞,尤其是 LDAP、Kafka 和 HATEOAS 中的关键 CVE。