LFM2.5-VL-3B:为边缘端带来更好更快的视觉能力

LiquidAI 于 8 月 12 日发布 30 亿参数的视觉语言模型 LFM2.5-VL-3B,在屏幕理解、目标定位、函数调用等能力上大幅提升,为端侧本地部署视觉 AI 提供更实用的选择。

LiquidAI 于 8 月 12 日发布 30 亿参数的视觉语言模型 LFM2.5-VL-3B,在屏幕理解、目标定位、函数调用等能力上大幅提升,为端侧本地部署视觉 AI 提供更实用的选择。

Google DeepMind发布手语转文字模型SL2T,并首次将其接入Pixel 11的Gboard和Live Transcribe,让美国手语用户可以像口语听写一样直接用手语输入。

Thrive Holdings是一家以收购AI服务公司为核心策略的投资方,刚刚完成20亿美元募

荣耀今天在中国发布了一款“机器人手机”,将三轴云台直接集成到手机背面。经过一小时上手测试,The Verge 认为它可能不是噱头,而是把小型稳定器塞进手机后,少数真正能做到“好看也好用”的产品。

Anthropic 宣布,为满足欧盟《AI 法案》透明度要求,所有 Claude 模型生成的内容(含纯文本)将从发布首日起嵌入不可见统计水印,并回溯至现有模型。这是主流闭源大模型中首个公开确认“全文水印”方案的动作,直接影响大量依赖 AI 文本的创作者和开发者。

Nvidia正在推进新一代开放权重模型Nemotron 4,最大版本参数规模至少达到1万亿,试图追平中国实验室已经率先实现的大模型量级,同时这也让Nvidia站到了自己核心客户的对面。

OpenAI 发布两份研究报告,显示企业 AI 使用正从“提问/辅助”转向“执行/交付”,但前沿公司与普通公司的采用差距在半年内扩大了约三倍,使用深度正成为新的分水岭。

AI 代码审查初创公司 CodeRabbit 完成 1.43 亿美元 C 轮融资,估值达 15 亿美元。这轮融资由 Atomico 和 Smash 联合领投,距离其 2025 年 9 月的 6000 万美元 B 轮融资仅不到一年,表明资本市场正在加速押注 AI 在软件工程质量环节的应用。

围绕“LLM擅长什么样的数学”的讨论提到,有开发者通过鼓励式提示让模型在黎曼猜想上取得了一些进展,但这些例子引发的是更深层的忧虑:AI能生成大量看起来像证明的东西,但能验证它们的人类正变得越来越稀缺。

OpenAI 于 2026 年 8 月 12 日发布 Linux 版 ChatGPT 桌面应用预览,把聊天助手、工作场景与 Codex 编程代理整合进单一界面;但也明确了首版不会提供桌面应用控制(computer use),功能覆盖仍不完整。