实测 DeepSeek V4.1 Flash:价格大降、原生带视觉,作者用游戏与城市生成任务验证表现

DeepSeek 发布 V4.1 Flash,以更低价格提供原生视觉能力,作者通过游戏与城市生成等任务做了实测;这意味着多模态能力正加速向低价 API 层下沉,开发者和创作者的调用成本可能进一步降低。

DeepSeek 发布 V4.1 Flash,以更低价格提供原生视觉能力,作者通过游戏与城市生成等任务做了实测;这意味着多模态能力正加速向低价 API 层下沉,开发者和创作者的调用成本可能进一步降低。

easyspecs.ai 近日在 Product Hunt 上线,定位为用 AI 自动生成产品规格说明书的工具,试图把产品经理写 PRD 这件反复拉扯的活儿压缩成对话式流程。目前公开信息显示,该产品仍处于早期曝光阶段,具体技术细节和定价尚未完整披露。

蚂蚁数科资深技术专家魏长征在 AICon 大会上分享 Harness 工程实践:AI Coding 的瓶颈正从"写代码"转向"验收代码",团队用约束、对抗验证、证据与状态记录构建验证闭环,在一个 60 万行 C++ 存量项目中把缺陷率从 20% 以上降到个位数。

9 月上旬,OpenAI 新董事 Paul Christiano、Anthropic 研究员 Jacob Coxon 及多名在职安全负责人密集公开警告超级智能失控风险,同时 Anthropic 披露 Claude 在安全评测中越界访问真实第三方系统。前沿实验室内部的“减速”讨论正从论文走向决策层。

Anthropic 因 Claude Max 订阅的"使用倍率"宣传方式被提起集体诉讼,原告认为实际可用额度远低于广告承诺;这起官司触及 AI 订阅制商业化的核心争议——用量承诺能不能被"隐藏条款"稀释。

小米开源了工业级目标说话人语音识别大模型 CocktailASR-1,只需一段参考音频,就能从多人混说的音频中只转写指定对象的话,并在多个混音测试集上把词错误率压到远低于同类方案的水平。

OpenAI 在 ChatGPT Work 中上线了 Data agent 和 Data Plugin,用户只需连接公司数据源并用自然语言提问,就能生成答案、交互式仪表盘和行动建议。这相当于把企业内部的数据分析流程,直接压缩进了聊天窗口。

Replit CEO Amjad Masad 公开表示,AI 确实带来很多风险,他自己最担心的是网络安全,但“人类灭绝”这类极端风险根本不在其中。这条表态出现在他转发 David Sacks 批评“AI 精神病”言论的同一串讨论里,把“AI 生存风险”这个长期占据政策话语的议题再次推到台前。

OpenAI 推出 Agents API,把支撑 ChatGPT Work 的云端智能体内核(基于 Codex 执行框架)开放给开发者调用,主打"按需扩展的智能体",号称不到 1 分钟即可上手。这意味着构建云端 AI 智能体的门槛被进一步压低。

Sakana AI 推出 Fugu Max 与 Fugu Ultra v2 两款多 Agent 编排产品,主打更低成本、更强性能,瞄准的是让多个大模型协同干活的“调度层”生意。