让Agent越用越强:AReaL2.0开源,打造面向自演进智能体的RL基础设施

2026年7月2日,开源强化学习基础设施项目AReaL发布2.0版本,旨在解决智能体(Agent)在真实业务场景中部署后“只工作不成长”的问题,让Agent能够在安全可控的前提下,通过在线强化学习从实际任务执行中持续学习和进化。

2026年7月2日,开源强化学习基础设施项目AReaL发布2.0版本,旨在解决智能体(Agent)在真实业务场景中部署后“只工作不成长”的问题,让Agent能够在安全可控的前提下,通过在线强化学习从实际任务执行中持续学习和进化。

美团通过内部通知严格限制使用字节跳动的“豆包”大模型,同步加速推进自研“LongCat”体系的全面落地,标志着国内头部互联网公司正加速构建自主可控的 AI 技术栈。

市场传闻快手旗下的AI视频生成平台“可灵AI”即将完成首轮独立融资,规模约30亿美元,估值达180亿美元。这一消息折射出国内AI视频赛道在商业化落地前夜,一级市场投资逻辑已从追捧技术概念转向更加审慎的估值博弈。

知名科技评论员 Ed Zitron 在社交媒体上以一种尖锐的比喻批评当前 AI 行业生态——大量公司不是在创造原创价值,而是在彼此“消化”对方的产品与数据,最终形成一个闭环的、互相依赖的“人体蜈蚣”式系统。这一观点引发了对 AI 商业模型本质的激烈讨论。

Markovian Protocol 提出了一种无需信任第三方“签名者”或“神谕”的验证方案:任何 AI 代理只需基于公开的输入、函数和比特币锚点,自行重播计算并验证结果,从而彻底去除了对中心化委员会的依赖。

一个名为 @urcryptocutie 的 AI 工具或账号引发了社区关注,但其功能和具体来源因信息缺失尚不明确。目前公开信息显示,这一现象可能代表了 AI 在社交互动或创作领域的新尝试,但其实际影响和真实性需进一步验证。

一位行业从业者在社交媒体上尖锐批评了当前AI Agent落地中的“过度包装”现象——许多人将本就适合用传统workflow解决的业务逻辑,强行包装成依赖大模型推理的AI Skill,导致成本飙升且难以生产部署。这一观点引发了关于AI落地方式务实性的讨论。

《华尔街日报》爆料 SpaceX 在 IPO 前向投资者展示了一款集成 xAI 技术的 AI 手机原型机,马斯克随即在 X 平台发文彻底否认该消息,称该报道完全虚假。

AI 技术专家孙天祥正式加入百度,担任基础模型研发部(BMU)负责人,并进入百度模型委员会(BMC)。这一关键人才引进,是百度将大模型研发体系拆分为“基础模型”与“应用模型”双轨制后的重要组织补强,有望加速文心基础模型的技术迭代。

月之暗面(Moonshot AI)旗下新一代大模型 Kimi K3 确认本月发布,其参数规模预计达到 2.5 万亿,届时可能成为国内参数最大的开源或闭源模型,超越百度文心 5.0 和 DeepSeek V4 Pro。