阿里巴巴的开放权重 Qwen3.8-Max 承担具有 2.4 万亿参数的长视野 AI 任务

阿里巴巴发布 Qwen3.8-Max,一个总参数 2.4 万亿、单次查询激活 950 亿参数的开放权重大模型,目标不是回答单轮问题,而是连续数天自主完成复杂任务。模型权重预计下周公开,这可能是国内大模型在“自主智能体”方向最激进的一次开源动作。

阿里巴巴发布 Qwen3.8-Max,一个总参数 2.4 万亿、单次查询激活 950 亿参数的开放权重大模型,目标不是回答单轮问题,而是连续数天自主完成复杂任务。模型权重预计下周公开,这可能是国内大模型在“自主智能体”方向最激进的一次开源动作。

腾讯CodeBuddy产品线全面接入DeepSeek-V4-Flash正式版,新模型在代码生成与智能体任务执行上较上一代明显增强,开发者已可通过WorkBuddy、CodeBuddy IDE等产品直接体验。

开发者尝试用 AI 把遗留 COBOL 程序迁移到 Java,结果发现 AI 连旧系统里的错误也一并“翻译”了过来。这个案例再次说明:AI 代码转换和真正意义上的系统现代化之间,还隔着巨大的差距。

DeepSeek 于 8 月 3 日推出 V4 Flash API 公测版,主打智能体(agent)能力大幅提升;消息公布后,竞品智谱股价盘中一度跌超 13%,国产大模型的 agent 能力竞赛正式进入白热化阶段。

金融 AI 项目 MicroWorld 把市场参与者、信息差和策略博弈直接放进世界模型,用分层多智能体和均值场博弈求解均衡价格。它的意义在于让 Agent 从“调用工具”走向“建模环境与其他 Agent”,但目前仍以合成演示和事后回放为主,实时有效性尚未被真实数据验证。

一条以“高维向量嵌入”“大语言模型特征对齐”等AI术语包装的X帖子,其真实指向是学位证、毕业证、银行流水等违规办证广告。借AI名词包装业务并不新鲜,但这条帖子的措辞已经能见出AI资讯领域正在出现“术语营销”污染。

AI 资讯账号 @dwd_com1 公开吐槽智能体赛道“越来越挤”,大量团队涌入 Agent 领域,却普遍停留在概念阶段,真正能稳定完成任务的成熟产品仍然稀缺。这一表态折射出行业对 Agent 落地进展的普遍焦虑。

阿姆贾德·马萨德(Amjad Masad)把他基于大语言模型(LLM)开发的国际象棋引擎放上了 LiChess,以约 1253 Elo 的评分开始,现已涨至约 1500,能够自主同时与人类和机器人对弈,并击败了 Stockfish 的较低等级版本。

8月初,AI产业同时迎来技术与监管两条线的关键节点:OpenAI被曝光的“Astra”多智能体模型家族瞄准复杂科研协同,而欧盟《人工智能法案》第50条透明度义务已于8月2日正式强制生效,企业级合规从原则讨论进入工程落地阶段。

AI 颠覆了“不能”与“不应”的边界,技术拓展能力时也在重构道德义务。我们应该开始追问:当 AI 让许多事从不可能变为可能,谁该为“可做却没做”负责?