从回答问题到把事办完,消费Agent还缺什么?飞猪新一代 AI 产品 V10 的一次探索

飞猪推出新一代AI产品V10,用AI Panel和“帮我想、帮我订、帮我办”把AI从“回答问题”推进到“完成交易与履约”。这件事值得关注的原因在于,它示范了消费级Agent如何在真实供给和交易约束下建立独立于大模型的应用价值。
先解决问题,再了解资讯。选择你现在要完成的任务。

飞猪推出新一代AI产品V10,用AI Panel和“帮我想、帮我订、帮我办”把AI从“回答问题”推进到“完成交易与履约”。这件事值得关注的原因在于,它示范了消费级Agent如何在真实供给和交易约束下建立独立于大模型的应用价值。

Amazon、Cursor、Microsoft、OpenAI 和 Vercel 联合推出名为 Agent Plugins 的开放标准,试图统一 AI 代理插件的打包与发现方式。这件事让开发者有望摆脱“每个平台重写一遍插件”的重复劳动,也让围绕 AI 代理生态的标准竞争变得更加明显。

Krea AI 正式推出 Seedance 2.5 视频模型,支持 30 秒连续视频、完整多镜头序列和最多 50 个参考输入,视频生成赛道在时长控制和多镜头叙事上又往前推进了一步。

谷歌母公司 Alphabet 计划发债 200 亿至 250 亿美元,软银则用持有的 OpenAI 股份作抵押借款 100 亿美元。两家巨头同时选择债务融资而非股权融资,意味着 AI 基础设施竞赛已进入高杠杆、长周期投入阶段。

投资人 Matt Turck 与 AI 初创公司 Basis 联合创始人 Mitch Troyanovsky 对话,公开了长周期 AI 代理的构建方法论——用行为规范定义任务边界、用本体论组织领域知识、用过程监督取代只看最终结果。这是 AI 从“能写代码数小时”走向“能完成真实工作”的一份具体经验样本。

Anthropic 调整了 Claude Fable 5 的生物安全策略,通过减少误报让模型能回答更多日常健康与科普问题;测试中生物类回退减少了约 85%,但病毒学、毒理学等敏感方向仍会切换至 Opus 5。

一位开发者发帖称,用 OpenAI Codex 搭配 GPT-5.6 Sol 连续对话 5 分钟,就完成了看似需要数周人工的工作,帖子在 X 上获得大量浏览,让“AI 代理自主执行复杂任务”再次成为社区讨论焦点。

Swyx 正在公开测试一个面向 AI 代理的代码托管平台 Smol Forge,首批开放 100 个 alpha 名额,核心思路是让 AI 代理直接作为“Git 远程仓库”的一等用户,而不是像现在这样由人操作 Git、AI 只负责写代码。

OpenAI 披露 ChatGPT 全球活跃用户已超过 10 亿,并观察到用户行为正在从“提问”转向“做事”——尤其在写作、编程、编辑和分析等工作场景中,ChatGPT 被更频繁地用于产出内容或执行任务。

谷歌 DeepMind 联合多家气象机构发布 WeatherNext Cyclones 气旋预测模型,能把高精度预报窗口从 2 天延长到 3 天,相当于把 AI 气象预报能力整体向前推进了约 24 小时,并同步开源了模型代码。