不靠最强大模型,也能拿全球第一?OceanBase 的 “纯国产组合” 登顶国际 Data Agent 榜

OceanBase 团队以国产数据库加国产大模型 GLM-5.2 的组合,在国际数据智能体基准 DAB 上以 90.62% 准确率排名第一,成为首个突破 90% 的参评方案,成绩超过多项基于 GPT、Claude 系列构建的方案。

OceanBase 团队以国产数据库加国产大模型 GLM-5.2 的组合,在国际数据智能体基准 DAB 上以 90.62% 准确率排名第一,成为首个突破 90% 的参评方案,成绩超过多项基于 GPT、Claude 系列构建的方案。

IDC 发布《中国 AI 算力管理平台技术能力评估,2026》,范式在算力资源管理、算力运维、技术架构、交付服务四个维度均获满分,综合评分位列第一。这说明当 AI 应用转向规模化落地,异构算力怎么"管好、调度好、算清账"正成为企业选型的关键指标。

InfoQ 刊发平安寿险高级工程师张阳的实践复盘,指出纯 LLM 方案做自然语言转 SQL(NL2SQL)在金融场景中会产生"静默错误",提出用本体工程把业务口径变成机器可校验的显性规则。对正在做企业级 AI 问数的团队,这是一份来自生产环境的踩坑参考。

数字生命卡兹克与字幕组、漫画汉化组从业者进行了一次对谈,聊的是 AI 翻译与图像生成工具普及后,这些长期依赖“人肉翻译+嵌字”的民间内容团队真实处境如何变化。这个话题值得关注,是因为它提供了一个少见的观察窗口:AI 对内容生产链条的冲击,往往先在版权灰区、非商业化、以兴趣驱动的小团队身上显现。

阿里通义千问发布 Qwen-Image-2.1,用 7B 参数的单检查点同时支持图像生成与编辑,并在 Hugging Face Spaces 上线免安装的浏览器 Demo。它的看点不在参数规模,而在于用一个模型覆盖两类任务,把开源图像模型的能力边界和工程可用性往前推了一步。

英伟达 CEO 黄仁勋在 CBS 采访中公开反驳"AI 将在数年内灭绝人类"的说法,称 2030 年世界末日概率为 0%,并反对为 AI 开发者增设额外监管。这番表态背后,是算力供应商与 AI 安全派在技术路线和监管话语权上的正面分歧。

阿里通义千问团队开源了 Qwen-Image-2.1 图像生成与编辑模型,视觉生成部分只有 70 亿参数,官方评测中表现超过多数闭源模型,且一张 RTX 3090 这类消费级显卡即可流畅运行。

支付宝 AI 助手阿宝近期上线「鱼来」摸鱼系统,首批发售 500 条虚拟鱼,用户通过语音指令即可随机召唤并设置每日休息提醒。这标志着阿宝的异步任务能力从「任务管理」延伸至「状态管理」,把原本零散的休息时间纳入 AI 调度。

阶跃星辰发布 Step 5 Preview,用 600B 总参数、每次只激活 27B 的稀疏 MoE 架构,在保持开源旗舰智能水平的同时把单任务成本压到 Claude Opus5 的约八分之一。完整权重将于 10 月 15 日开放。

阿里通义千问团队于 9 月 21 日开源 Qwen-Image-2.1,用 7B 参数的单一模型同时完成文生图、透明图生成和图像编辑,免费开放给开发者与创作者。