Agent 如何自我进化出 Skill?浙江大学-阿里巴巴集团人工智能安全联合实验室专场直播回放 (1)

浙江大学与阿里巴巴的联合研究团队发布了两篇论文,提出了一套让 AI Agent(智能体)在没有人工干预的情况下,自主迭代生成、修正并优化自身“技能包”(Skill)的方法。其核心创新在于用一个“代理验证器”替代真实测试反馈,驱动 Agent 通过多轮自我进化,最终生成的技能包不仅比人工编写的更有效,还能跨模型…

浙江大学与阿里巴巴的联合研究团队发布了两篇论文,提出了一套让 AI Agent(智能体)在没有人工干预的情况下,自主迭代生成、修正并优化自身“技能包”(Skill)的方法。其核心创新在于用一个“代理验证器”替代真实测试反馈,驱动 Agent 通过多轮自我进化,最终生成的技能包不仅比人工编写的更有效,还能跨模型…

阿里达摩院联合人大高瓴人工智能学院、中国科学院大学,发布了专攻超导材料发现的AI智能体“ElementsClaw”(元素虾)。它仅用28个GPU小时,就从240万种稳定晶体中预测出6.8万种可能超导的材料,并在实验验证中发现了4种人类此前完全未知的新超导体,大大提升了超导材料筛选效率。

大晓机器人首席科学家陶大程在公开技术分析中提出,当前行业对世界模型的评价应从“像素逼真度”转向“能否有效支撑机器人行动”,并系统阐述了具身世界模型应以“行动代价最小化”为设计核心。这一观点直接挑战了通用生成式世界模型的主流评价标准,为具身智能从实验室走向产业化提供了更聚焦落地的底层判断框架。

OpenAI 已推出自研推理芯片 Jalapeño,Anthropic 也接触三星探讨芯片合作。两家头部大模型公司正从“买算力”转向“定义算力”,目的不是取代英伟达,而是通过定制硬件优化推理成本,为大规模 AI 产品商业化铺路。

Anthropic 在最新演讲中透露,已将 Claude Code 的系统提示词删减 80%,并推出更高效的 Fable 5 模型。此举背后是 AI 行业 token 成本失控的现实——Anthropic 花在算力上的钱已是薪资支出的 2.3 倍,大公司如 Uber、花旗已开始严格管控 AI 使用预算,行业正…

Anthropic 旗下 Claude 团队宣布将于 2026 年 7 月 7 日至 13 日举办“Built with Claude: Life Sciences”主题黑客马拉松,申请截止日期为 7 月 5 日(周日)。这是 Claude 首次聚焦生命科学领域的正式开发者活动,旨在推动 AI 大模型在生物医…

Claude 团队宣布联合 Gladstone 研究所,举办一场面向生命科学领域的全球虚拟黑客马拉松,总奖金池为 10 万美元的信用额度,参赛者将使用 Claude Science 和 Claude Code 工具进行为期一周的研究与开发。

NVIDIA 研究实验室负责人 Bryan Catanzaro 在深度对话中首次系统解释了公司为何在芯片业务之外,投入数百名研究人员构建并免费开源 Nemotron 系列模型(从 Nano 到 Super、Ultra)。这场对话揭示了 NVIDIA 将 AI 模型视为推动算力需求的“催化剂”,而非直接盈利产品…

Anthropic 发布了《克劳德寓言 5》播客,由公司内部两位关键人物 Boris Cherny 和 Cat Wu 对谈,首次公开回顾了 Claude Code 这一 AI 编程工具如何在工程团队内部诞生、逐渐扩散至全公司,并最终演化为一个更通用的产品形态——Claude Tag。这不仅是产品迭代的回顾,更…

一名刚毕业的大学毕业生向AI行业研究员Zara Zhang透露,在校期间,他会把课堂讲义交给AI模型,让AI代替自己学习并讲授内容,结果发现AI的教学效果往往好于真实教授。这件事折射出生成式AI在个性化教育场景中已具备实用价值,同时也正在改变传统高等教育的“授课-学习”模式。