AI 聊天机器人大多数时候会答错金融问题

英国《金融时报》报道称,AI 聊天机器人在回答金融类问题时“大多数时候”给出错误答案,这一结论提醒人们:把通用大模型直接当作投资或理财顾问,风险比想象中高得多。

英国《金融时报》报道称,AI 聊天机器人在回答金融类问题时“大多数时候”给出错误答案,这一结论提醒人们:把通用大模型直接当作投资或理财顾问,风险比想象中高得多。

OceanBase 团队以国产数据库加国产大模型 GLM-5.2 的组合,在国际数据智能体基准 DAB 上以 90.62% 准确率排名第一,成为首个突破 90% 的参评方案,成绩超过多项基于 GPT、Claude 系列构建的方案。

IDC 发布《中国 AI 算力管理平台技术能力评估,2026》,范式在算力资源管理、算力运维、技术架构、交付服务四个维度均获满分,综合评分位列第一。这说明当 AI 应用转向规模化落地,异构算力怎么"管好、调度好、算清账"正成为企业选型的关键指标。

数字生命卡兹克与字幕组、漫画汉化组从业者进行了一次对谈,聊的是 AI 翻译与图像生成工具普及后,这些长期依赖“人肉翻译+嵌字”的民间内容团队真实处境如何变化。这个话题值得关注,是因为它提供了一个少见的观察窗口:AI 对内容生产链条的冲击,往往先在版权灰区、非商业化、以兴趣驱动的小团队身上显现。

支付宝 AI 助手阿宝近期上线「鱼来」摸鱼系统,首批发售 500 条虚拟鱼,用户通过语音指令即可随机召唤并设置每日休息提醒。这标志着阿宝的异步任务能力从「任务管理」延伸至「状态管理」,把原本零散的休息时间纳入 AI 调度。

阶跃星辰发布 Step 5 Preview,用 600B 总参数、每次只激活 27B 的稀疏 MoE 架构,在保持开源旗舰智能水平的同时把单任务成本压到 Claude Opus5 的约八分之一。完整权重将于 10 月 15 日开放。

阿里通义千问团队于 9 月 21 日开源 Qwen-Image-2.1,用 7B 参数的单一模型同时完成文生图、透明图生成和图像编辑,免费开放给开发者与创作者。

法拉第未来(FF)在9月19日一次性发布九款 EAI 机器人,覆盖人形与四足两种形态,价格从约 6.7 万元到 92.6 万元,并宣布全部产品已开启销售与交付。这意味着 FF 正把机器人作为比造车更完整的产品线来推进,但高价与场景落地仍是关键变量。

OceanBase 团队以内部代号 Scout 的 Data Agent 方案,在国际 Data Agent Benchmark(DAB)上取得 90.62% 准确率并排名第一,成为该榜单首个突破 90% 的提交。更值得关注的是,它使用国产大模型 GLM-5.2,超过了多个基于 GPT、Claude Opus…

特斯拉得州超级工厂的 Optimus 人形机器人产线主体钢结构接近完工,三层结构已在浇筑混凝土,但距离量产还有设备安装与产线调试等环节。这条产线的规划节奏,将直接影响人形机器人从展示样机走向规模化交付的时间表。