中文医疗大模型迎来重大升级,MedBench 5. 0 版本正式发布筑牢安全防线

上海人工智能实验室联合钟南山、葛均波院士团队发布中文医疗大模型评测基准 MedBench 5.0,首次引入“医学原子技能”评测范式,目的是用更细颗粒度的能力拆解来约束和纠正大模型的“幻觉”问题,为医疗 AI 的应用设下一道可验证的安全门槛。

上海人工智能实验室联合钟南山、葛均波院士团队发布中文医疗大模型评测基准 MedBench 5.0,首次引入“医学原子技能”评测范式,目的是用更细颗粒度的能力拆解来约束和纠正大模型的“幻觉”问题,为医疗 AI 的应用设下一道可验证的安全门槛。

Meta在2026年Q2财报中披露,Instagram用大语言模型(LLM)升级推荐系统后,用户单次会话时长实现同比双位数增长;这是生成式AI首次大规模接管社交平台内容分发,但也让青少年保护和监管争议进一步升温。

Google 借助 Gemini 等 AI 工具,在 6 月发布的两个 Chrome 版本里修复了 1072 个安全漏洞,数量超过了过去两年 23 个版本修复漏洞的总和(1036 个),漏洞攻防的节奏正被 AI 大幅改写。

7月31日,华为正式开源openPangu-2.0-Pro大模型,总参数5050亿、每Token激活约180亿参数,权重、推理代码与技术报告同步放出。这是昇腾AI生态在模型层面的一次关键补强,也让“国产开源

《星际迷航》演员 Jeri Ryan 接受采访时公开推荐观众重看《终结者》系列,认为在当下 AI 快速渗透社会的阶段,这两部电影能提醒人们正视技术失控的后果。她同时透露自己已支持一项要求披露“合成数字表演者”身份的加州法案。

AI公司开始绕过已经“被污染”的互联网,跑到二手书店批量收购旧书,甚至通过破坏性扫描把实体书变成大模型训练数据。这解释了为什么近期美国、欧洲二手书市场出现异常大宗采购,也把AI训练的版权争议从线上烧到了线下。

马斯克多年前在MIT研讨会上用“召唤恶魔”比喻AI开发风险,认为人类一旦造出足够强大的机器智能,很可能无法控制。这个说法至今仍在被讨论,因为它浓缩了AI行业关于“加速前进还是安全第一”的核心分歧。

Reddit CEO 在财报前公开吐槽 Google 的 AI Overviews 没有带来类似传统搜索的流量价值,并暗示可能重新评估与 Google 的授权合作。这反映出 AI 搜索摘要与内容平台之间正在出现明显的利益冲突。

AI 平台 B.AI 宣布累计注册用户突破 205 万,这一数字来自其官方及 TRON 生态成员在 2026 年 7 月 30 日发布的消息。该里程碑反映 AI Agent 类产品在全球范围内的用户接受度正在快速提升,平台方则强调将进一步打通算力、Agent 与金融基础设施,降低开发与使用门槛。

Google DeepMind 推出了三款基于 Gemini 2.0 的实体 AI 模型,分别专注全身协调控制、高精度灵巧操作和多机器人协同作业。这是视觉-语言-动作(VLA)模型从“会看会说”到“动手做事”的一次系统性升级。