通义千问发布 Qwen-Image-2.1:7B 单检查点同时支持图像生成与编辑

阿里通义千问发布 Qwen-Image-2.1,用 7B 参数的单检查点同时支持图像生成与编辑,并在 Hugging Face Spaces 上线免安装的浏览器 Demo。它的看点不在参数规模,而在于用一个模型覆盖两类任务,把开源图像模型的能力边界和工程可用性往前推了一步。

阿里通义千问发布 Qwen-Image-2.1,用 7B 参数的单检查点同时支持图像生成与编辑,并在 Hugging Face Spaces 上线免安装的浏览器 Demo。它的看点不在参数规模,而在于用一个模型覆盖两类任务,把开源图像模型的能力边界和工程可用性往前推了一步。

阿里通义千问团队开源了 Qwen-Image-2.1 图像生成与编辑模型,视觉生成部分只有 70 亿参数,官方评测中表现超过多数闭源模型,且一张 RTX 3090 这类消费级显卡即可流畅运行。

支付宝 AI 助手阿宝近期上线「鱼来」摸鱼系统,首批发售 500 条虚拟鱼,用户通过语音指令即可随机召唤并设置每日休息提醒。这标志着阿宝的异步任务能力从「任务管理」延伸至「状态管理」,把原本零散的休息时间纳入 AI 调度。

阿里通义千问团队于 9 月 21 日开源 Qwen-Image-2.1,用 7B 参数的单一模型同时完成文生图、透明图生成和图像编辑,免费开放给开发者与创作者。

法拉第未来(FF)在9月19日一次性发布九款 EAI 机器人,覆盖人形与四足两种形态,价格从约 6.7 万元到 92.6 万元,并宣布全部产品已开启销售与交付。这意味着 FF 正把机器人作为比造车更完整的产品线来推进,但高价与场景落地仍是关键变量。

特斯拉得州超级工厂的 Optimus 人形机器人产线主体钢结构接近完工,三层结构已在浇筑混凝土,但距离量产还有设备安装与产线调试等环节。这条产线的规划节奏,将直接影响人形机器人从展示样机走向规模化交付的时间表。

旧金山初创公司 TypeSafe AI 推出决策专用模型 Jev,不做文本生成,只输出可被程序直接使用的“是/否”或选择题结果并附带置信度,官方称在同类任务上比大语言模型快 10 倍、成本约为其十分之一。

OpenAI 发布了一套模型失准披露框架,并一次性公开六份真实案例报告,指出模型越界行为背后存在三种可复现的机制,而问题往往不出在最终交付物上。

瑞典 AI 创业公司 Scaleout Systems 用一块消费级 Nvidia Jetson Orin Nano 板卡,跑小型视觉模型,让无人机在无外部通信、AI 全程在机上推理的条件下自主选定并攻击了一辆装甲工程车,全程仅约 320 秒。

ChatGPT 的图像生成能力新增了贴纸专用流程,用户可以在 iOS 和 Android 应用里把照片直接转成九张一组、能导入 iMessage 和 WhatsApp 使用的表情贴纸,操作门槛比多数人预想的低。