AI 聊天机器人大多数时候会答错金融问题

英国《金融时报》报道称,AI 聊天机器人在回答金融类问题时“大多数时候”给出错误答案,这一结论提醒人们:把通用大模型直接当作投资或理财顾问,风险比想象中高得多。

英国《金融时报》报道称,AI 聊天机器人在回答金融类问题时“大多数时候”给出错误答案,这一结论提醒人们:把通用大模型直接当作投资或理财顾问,风险比想象中高得多。

据 Politico 报道,白宫与 Anthropic 因一次越狱(jailbreak)争议陷入 19 天对峙,官员直接要求 CEO Dario Amodei 将模型 Fable 下线。这件事把前沿模型的发布节奏与政府安全审查之间的矛盾摆到了台面上。

美国财长贝森特透露,美中官员在纽约会谈中讨论了为影响国家安全的 AI 事件建立“通报机制”,为本周特朗普与习近平的华盛顿峰会铺路。这是全球两大 AI 力量首次公开提及在 AI 安全领域建立跨境信息沟通渠道。

一名研究者借助 GPT-6 Astra 破译了一封 1918 年一战德军无线电密文,该密文此前被收录在德国科学博客 prinz 整理的“50 个著名未解密码”清单中。这为“大模型能否参与真实历史密码破译”提供了一个可核验的案例,而不只是演示层面的炫技。

Phillip Mortimer 在 QCon London 提出,AI 生成的代码正变得“只写且不可读”,人工逐行审查已不现实,开发者应把测试当作文档、把代码当作可丢弃的产物,并让智能体通过可观测性自我修复。

蚂蚁集团将在 2026 年 QCon 上海站分享新一代大模型训练数据处理系统 Altum,试图用系统化工程手段解决训练数据环节的 GPU 效能、任务稳定性和交付时效难题。

GitHub 为 Copilot 推出研究预览功能 HydraFusion,不再固定用一个大模型,而是按任务难度在多个模型间动态调度,官方测试显示质量不降的同时成本大幅下降。

在 Langfuse Tracing 列表把 Row height 设为 Large 后,行虽然变高,但 Input/Output 文本仍被截断、无法占满行高,这通常属于前端表格组件的 CSS 高度传递问题;优先排查 DataTable 单元格中间包裹层是否正确继承行高。

OceanBase 团队以国产数据库加国产大模型 GLM-5.2 的组合,在国际数据智能体基准 DAB 上以 90.62% 准确率排名第一,成为首个突破 90% 的参评方案,成绩超过多项基于 GPT、Claude 系列构建的方案。

IDC 发布《中国 AI 算力管理平台技术能力评估,2026》,范式在算力资源管理、算力运维、技术架构、交付服务四个维度均获满分,综合评分位列第一。这说明当 AI 应用转向规模化落地,异构算力怎么"管好、调度好、算清账"正成为企业选型的关键指标。