商汤 SenseNova U1 开源:统一推理与图像生成

商汤发布并开源了 SenseNova U1 模型,它能在一个统一流程里同时完成推理和图像生成,属于多模态大模型的一次技术整合,值得关注的不仅是效果,更是“开源”背后的生态意图。

商汤发布并开源了 SenseNova U1 模型,它能在一个统一流程里同时完成推理和图像生成,属于多模态大模型的一次技术整合,值得关注的不仅是效果,更是“开源”背后的生态意图。

Black Forest Labs 的 FLUX 3 Video 正式在 OpenRouter 上向所有用户开放,这是一个覆盖视频、音频、图像与动作预测的统一多模态模型家族,开发者可通过 OpenRouter 的 Video API 直接调用。

据纽约时报报道,美国政策制定者正在调整思路,从“监管开源AI”转向“推动本土AI模型更具竞争力”,这个转向可能影响全球开源与闭源模型的生态平衡。

AI 云基础设施公司 Volta 完成由 a16z 和 Altimeter 联合领投的 3 亿美元融资,估值达 24 亿美元,同时还披露了一笔价值 100 亿美元的算力合同。这笔订单体量远超其估值,说明头部 AI 开发者正在以长期合约锁定稀缺算力,AI 云服务市场竞争正在加速。

AI 的算力瓶颈正在从“缺芯片”变成“缺电”,大型科技公司为了锁定电力供应,正在向银行寻求巨额融资承诺,这已经开始重塑信贷市场。

一款名为 VIDEO AI ME 的视频 AI 产品出现在 Product Hunt 上,目前公开信息有限,但它再次说明视频生成与编辑类应用正成为 AI 产品化的热门方向,值得创作者和开发者留意。

商汤发布了一款 8B 参数的开源多模态模型 SenseNova U1.5-Lite-Preview,图像生成与编辑能力接近商业闭源模型,同时预告了面向专业创作者的 U1Pro 公测。

创作者 Peter Yang 发布了一条简短推文“ChatGPT 是用于创造回忆的”,引发用户讨论:有人拿 Claude 在非洲沙漠指错路来对比,也有人称赞 ChatGPT 能把散乱的照片和笔记做成互动故事书。这条推文的真正看点,是 AI 聊天工具正在从“解决问题”走向“制造情感体验”。

商汤开源了轻量级统一多模态模型 SenseNova U1.5-Lite-Preview,用 8B-MoE 的参数量实现 4K 图像生成与编辑。它没有走“堆参数”路线,而是靠架构和训练优化换取能力提升,值得关注。

苹果向美国法院申请初步禁令,要求禁止OpenAI及两名跳槽前员工使用或披露其商业秘密。这起诉讼把两家头部AI公司之间的竞争从模型和产品层面拉到了法律层面,值得关注。