Meta的Muse在移动端早期表现上正超越ChatGPT

Meta 新推出的 AI 应用 Muse 在移动端上线前 12 天的下载量和日活用户,按可比口径已超过 ChatGPT 当年同期的表现。这意味着社交巨头用分发优势切入 AI 应用市场,可能比技术领先者更快触达大众用户。

Meta 新推出的 AI 应用 Muse 在移动端上线前 12 天的下载量和日活用户,按可比口径已超过 ChatGPT 当年同期的表现。这意味着社交巨头用分发优势切入 AI 应用市场,可能比技术领先者更快触达大众用户。

风险投资人 Tomer Tunguz 观察到,一类专用"if-then 判断器"正在替代大模型处理简单分类任务,在他的实测中把成本降低约百倍、准确率反而从 47% 升到 80% 以上,这意味着 AI 推理可能正在分化为"探索用大模型、生产用小模型"的两套经济体系。

一位开发者公开主张:Claude、ChatGPT、Gemini 可以用来写代码、查资料、整理数据,但不要用来替你写文章——因为写作的真正价值在于逼你想清楚问题,而这一步 AI 帮不了你。

9 月 21 日起,Eufy E25 扫拖机器人在 Amazon 降至 599.98 美元,较 999.99 美元的原价便宜约 400 美元,且距离历史最低价仅差约 2 美元。这波降价出现在 10 月 Prime Day 之前,说明清洁机器人品类的价格战已经提前开打。

西班牙首相桑切斯在发布本国 AI 战略 Plan IA360 时公开表示,AI 行业部分大佬的安全警告可能带有融资动机,并强调“自我监管行不通”。这把“AI 该不该被强监管”的争论,从行业内部推到了国家级政策层面。

JevHarness 让大模型自己写出任务专属的决策流程,冻结后由轻量 Jev 模型做高速判断,宝可梦对战任务经 5 轮迭代把胜率从 25% 提到 75%。它的价值在于把“反复手写提示词和判据”的活交给 LLM,线上只跑代码加快速推理。

一名新入职大型科技公司的工程师公开表示,他所在团队从需求文档、代码、测试到工单和报告几乎全部由 Claude Code 生成,工程师的主要动作变成与 AI 对话并按回车。马斯克在相关讨论下回复“Yikes”,让这场关于 AI 编程真实落地状态的吐槽被更多人看到。

科技博主 @Gorden_Sun 在 X 上发布了一张「请选择你的AI Bot」的图片,让用户从多款主流 AI 助手中挑选自己的阵营,帖子获得近 3 万次浏览,评论区迅速演变成关于模型梯队与排位的争论。

复旦团队把 86 页 LLM Agent 综述《The Rise and Potential of Large Language Model Based Agents》的配套论文清单开源到 GitHub,并按"大脑—感知—行动"三层重新组织阅读路径,试图给快速膨胀的 Agent 研究建一张可导航的地图。

苹果同意支付 2.5 亿美元,和解“Apple Intelligence 与新版 Siri 未如期兑现”的集体诉讼,符合条件的美国 iPhone 用户现可提交索赔,每台设备预计约 25 美元。