DeepSeek-V4-Flash正式版上线,130亿激活参数撬动Agent战场

DeepSeek于7月31日低调上线V4-Flash API正式版公测,以130亿激活参数在多项Agent基准测试中逼近甚至超过三个月前的V4-Pro预览版,并首次公开自研Agent框架DeepSeek Harness。这是DeepSeek用轻量模型切入Agent市场的明确信号。

DeepSeek于7月31日低调上线V4-Flash API正式版公测,以130亿激活参数在多项Agent基准测试中逼近甚至超过三个月前的V4-Pro预览版,并首次公开自研Agent框架DeepSeek Harness。这是DeepSeek用轻量模型切入Agent市场的明确信号。

微软刚刚交出年营收破千亿美元的成绩单,但云业务增速被谷歌云以82%的增幅反超,第三方芯片依赖和订单集中问题让这千亿营收成色打折。

微信公众号平台上线AI“一键排版”功能,把自动分段、生成小标题、匹配图片三个高频操作合并为一次点击,这是AI能力在内容生产链路中的一次具体落地。

多方线索显示 DeepSeek V4 正式版可能于 8 月 3 日发布——硅基流动平台当天将调整 V4 Pro 缓存价格,部分 API 也已提前展现了更强的能力。若消息属实,这将是近期开源大模型领域最关键的一次版本落地。

荷兰保险公司Univé没有把ChatGPT Enterprise当作普通IT工具部署,而是通过领导层定方向、治理给安全感、员工自主创造的方式,让约1500个自定义GPT和日常AI工作流进入核心业务。值得关注的是,它提供了“AI落地不是买工具,而是建组织能力”的参考样本。

OpenAI在欧盟《人工智能法案》进入新实施阶段时,公开了其安全、透明度和内容溯源方面的合规路径,并参与了两项欧洲AI实践守则。这是头部大模型公司主动适应区域监管的典型动作,值得关注。

<section class="cge-quick-answer" data-content-type="ai

MarbleOS 在 Hacker News 上展示了一款面向 AI 智能体的图形化工作空间,把文件、工具、任务和输出从聊天线程里拿出来,变成可见的操作界面。它试图回答一个被忽视的问题:当 AI 从对话工具变成工作主体时,人应该用什么界面来管理它。

一个名为 HUMAN2LLM 的网页以医疗诊所式的广告口吻,煞有介事地提供“人类转大模型”的付费改造服务,本质是对 AI 崇拜、拟人化叙事和商业话术的一次集体调侃。

Omnigent 提出了一套以策略(Policy)约束多 Agent 协作的金融研究工作流方案,把合规规则嵌入 AI 分析流程,而不再让大模型自由发挥。它代表大模型在金融领域正从“能用”走向“可管、可控、可审计”。