标签: 算力

【开放权重模型差距缩至约2个月】 1、从2023年初到2026年中,开放权重模型追赶前沿闭源模型的速度持续加快,关键AI基准测试中的性能落后时间已从约13个月逐步缩小至约2个月,技术差距明显收窄。 2、图中呈现出周期性「拉开—追赶」节奏:每当新一代前沿模型发布,性能领先优势会短暂扩大至约8-16个月,但随后开源社区快速复现创新,差距又迅速回落至4个月以内。 3、随着开放权重模型迭代速度不断提升,模型能力正加速商品化。未来AI竞争的重心…

【开放权重模型差距缩至约2个月】 1、从2023年初到2026年中,开放权重模型追赶前沿闭源模型的速度持续加快,关键AI基准测试中的性能落后时间已从约13个月逐步缩小至约2个月,技术差距明显收窄。 2、图中呈现出周期性「拉开—追赶」节奏:每当新一代前沿模型发布,性能领先优势会短暂扩大至约8-16个月,但随后开源社区快速复现创新,差距又迅速回落至4个月以内。 3、随着开放权重模型迭代速度不断提升,模型能力正加速商品化。未来AI竞争的重心…

根据@aidata8888发布的数据,开放权重模型在关键AI基准测试中追赶闭源前沿模型的差距,已从2023年初的约13个月缩小到2026年中期的约2个月。这意味着「开源跟上闭源」的节奏正在加快,模型能力的商品化趋势进一步显现。

DeepMind把手语输入送进Pixel,微信亮出WeLM|8月12日 AI Radar 夜间加更 上午公开稿发出以后,晚间增量集中在两处。多模态模型开始进入手语输入、工业设计和机器人维修这些更具体的动作面。Agent 工程也继续往依赖图、登录态、提醒恢复和长期运维里走。这里收录 12 条,只写上午 9 点 31 分以后出现的新发布、新实测和新争议。 上午已经写过的 ChatGPT Linux、Nemotron 3.5、Grok Bo…

DeepMind把手语输入送进Pixel,微信亮出WeLM|8月12日 AI Radar 夜间加更 上午公开稿发出以后,晚间增量集中在两处。多模态模型开始进入手语输入、工业设计和机器人维修这些更具体的动作面。Agent 工程也继续往依赖图、登录态、提醒恢复和长期运维里走。这里收录 12 条,只写上午 9 点 31 分以后出现的新发布、新实测和新争议。 上午已经写过的 ChatGPT Linux、Nemotron 3.5、Grok Bo…

DeepMind 将手语转文字功能送进 Pixel 11,微信发布 WeLM 模型家族,多模态与 Agent 工程开始进入手语输入、工业设计、机器人自修等更具体的动作层面。

看到 Liquid AI 发的这个新模型,我第一反应是去查它报的分数是不是真的。 LFM2.5-VL-3B,一个 3B 级别的视觉语言模型,主打一件事,看懂屏幕。手机界面、网页、桌面软件都能读,能把看到的东西标到坐标上,能读文字和图表,还能直接调用工具。这代最大的变化是可以用图片触发工具调用,不用先打字。 架构是 LFM2.5-2.6B 主干加 SigLIP2 400M 视觉编码器,总共 3.1B 参数,预训练约 34T token,…

看到 Liquid AI 发的这个新模型,我第一反应是去查它报的分数是不是真的。 LFM2.5-VL-3B,一个 3B 级别的视觉语言模型,主打一件事,看懂屏幕。手机界面、网页、桌面软件都能读,能把看到的东西标到坐标上,能读文字和图表,还能直接调用工具。这代最大的变化是可以用图片触发工具调用,不用先打字。 架构是 LFM2.5-2.6B 主干加 SigLIP2 400M 视觉编码器,总共 3.1B 参数,预训练约 34T token,…

Liquid AI 开源了一款 3B 参数级别的视觉语言模型 LFM2.5-VL-3B,主打屏幕理解与工具调用能力,能在手机、网页和桌面软件中识别界面元素、输出坐标并直接执行操作,且可在端侧设备流畅运行,为小模型在“智能体+端侧”方向上提供了一个新选项。