DeepSeek-V4-Flash 正式版上线国家超算互联网:一键调用,性能叫板最强闭源模型

DeepSeek 于 2026 年 8 月 3 日正式发布 V4-Flash 稳定版,并同步上线国家超算互联网,提供 API 调用和模型文件下载。这款新模型在多项基准测试中已接近当前最强闭源模型,同时大幅降低了开发者和企业用户的接入门槛。

DeepSeek 于 2026 年 8 月 3 日正式发布 V4-Flash 稳定版,并同步上线国家超算互联网,提供 API 调用和模型文件下载。这款新模型在多项基准测试中已接近当前最强闭源模型,同时大幅降低了开发者和企业用户的接入门槛。

阿里巴巴发布 Qwen3.8-Max,一个总参数 2.4 万亿、单次查询激活 950 亿参数的开放权重大模型,目标不是回答单轮问题,而是连续数天自主完成复杂任务。模型权重预计下周公开,这可能是国内大模型在“自主智能体”方向最激进的一次开源动作。

商汤宣布开源轻量级统一多模态模型 SenseNova U1.5-Lite-Preview,以 8B 参数规模实现原生 4K 图像生成和更强的图像编辑能力,降低了高质量多模态模型的使用门槛。

MerchUp AI 是在 Product Hunt 上出现的一款面向周边商品设计的 AI 工具,它试图让用户通过文本描述直接生成可用于 T 恤、卫衣、手机壳等商品的图案,核心价值在于降低创意商品化的设计门槛。

NVDA 确认 CPO(共封装光学)技术进入大规模应用阶段,带动光模块与网络芯片股上涨;与此同时,OpenAI 被曝下一代模型 Astra 主打多智能体协作,宣称解决多个长期未解数学难题。本周美股迎来财报密集周,市场情绪受韩国存储股暴跌与 AI 资本开支上调双重影响。

一项针对12万篇论文的大规模研究发现,大语言模型和人类科学家一样倾向保守,但AI可以并行试错上万次,真正制约它挑战科学共识的,不是缺少灵感,而是科研体系愿不愿意为低概率方向持续付费。

AI 资讯博主 @Lucy_love_AI 整理了一份 10 个开源 GitHub 仓库清单,帮助用户在本地硬件上运行大语言模型和 AI 工具,其中 GPT4All 因安装简单、无需高端 GPU 就能私密运行模型而受到关注。这反映出“本地 AI”正从技术爱好者的玩具,变成普通用户也能上手的实用方案。

本周AI产业呈现“钱和人”两条主线:寒武纪用数百亿营收目标绑定超八成员工,字节跳动把飞书并入豆包团队,月之暗面估值冲到350亿美元;与此同时,宇树科技员工IPO认购、Claude隐私泄露等事件提醒市场,AI公司的治理和数据合规正在变得和模型能力一样重要。

阿姆贾德·马萨德(Amjad Masad)把他基于大语言模型(LLM)开发的国际象棋引擎放上了 LiChess,以约 1253 Elo 的评分开始,现已涨至约 1500,能够自主同时与人类和机器人对弈,并击败了 Stockfish 的较低等级版本。

这条行业观察将物理AI、企业级应用与算力基础设施并置,提示AI产业的重心正从模型参数竞赛转向真实场景落地与底层资源匹配,值得开发者和采购方提前关注算力形态的变化。