分类: AI 资讯

生成式ai已经out了,all in 世界大模型! 1⃣什么是世界大模型? 如果说 GPT 是“文科生”(懂语言逻辑),那世界大模型就是“理科生”(懂物理定律)。 它不只是生成视频,而是能理解重力、因果、空间和碰撞。它在大脑里对现实世界进行物理仿真。 2⃣为什么它是下一波浪潮? 它是通往 AGI 和具身智能的钥匙。AI 只有感知物理世界,才能真正走出屏幕,进入现实世界操控机械臂或驾驶汽车。 3⃣核心关联美股标的: 🔹 领跑者(模型与算…

生成式ai已经out了,all in 世界大模型! 1⃣什么是世界大模型? 如果说 GPT 是“文科生”(懂语言逻辑),那世界大模型就是“理科生”(懂物理定律)。 它不只是生成视频,而是能理解重力、因果、空间和碰撞。它在大脑里对现实世界进行物理仿真。 2⃣为什么它是下一波浪潮? 它是通往 AGI 和具身智能的钥匙。AI 只有感知物理世界,才能真正走出屏幕,进入现实世界操控机械臂或驾驶汽车。 3⃣核心关联美股标的: 🔹 领跑者(模型与算…

2026年8月12日,加密及科技投资人九哥.eth(@CR9Crypto)在 X 上发文,主张“生成式 AI 已 out,all in 世界大模型”,将能够理解物理规律、对现实世界进行仿真的“世界大模型”定义为下一波 AI 浪潮,并列出微软、英伟达、谷歌、特斯拉、Meta、亚马逊等核心关联美股标的。

看到 Liquid AI 发的这个新模型,我第一反应是去查它报的分数是不是真的。 LFM2.5-VL-3B,一个 3B 级别的视觉语言模型,主打一件事,看懂屏幕。手机界面、网页、桌面软件都能读,能把看到的东西标到坐标上,能读文字和图表,还能直接调用工具。这代最大的变化是可以用图片触发工具调用,不用先打字。 架构是 LFM2.5-2.6B 主干加 SigLIP2 400M 视觉编码器,总共 3.1B 参数,预训练约 34T token,…

看到 Liquid AI 发的这个新模型,我第一反应是去查它报的分数是不是真的。 LFM2.5-VL-3B,一个 3B 级别的视觉语言模型,主打一件事,看懂屏幕。手机界面、网页、桌面软件都能读,能把看到的东西标到坐标上,能读文字和图表,还能直接调用工具。这代最大的变化是可以用图片触发工具调用,不用先打字。 架构是 LFM2.5-2.6B 主干加 SigLIP2 400M 视觉编码器,总共 3.1B 参数,预训练约 34T token,…

Liquid AI 开源了一款 3B 参数级别的视觉语言模型 LFM2.5-VL-3B,主打屏幕理解与工具调用能力,能在手机、网页和桌面软件中识别界面元素、输出坐标并直接执行操作,且可在端侧设备流畅运行,为小模型在“智能体+端侧”方向上提供了一个新选项。

微软首发自研推理模型MAI-Thinking-1

微软首发自研推理模型MAI-Thinking-1

微软 AI 部门在 2026 年 8 月 12 日发布了首款自研推理模型 MAI-Thinking-1,该模型从零训练,而非基于第三方开源模型微调,目前已在 Microsoft Foundry 开放试用。这件事值得关注,因为它表明微软开始具备独立于 OpenAI 的自研大模型能力。