DeepSeek-v4-flash-vision-exp

DeepSeek 发布了名为 deepseek-v4-flash-vision-exp 的实验性视觉模型,它能直接读取图片中的文字、图表和画面内容,并通过标准 OpenAI 兼容接口调用。这是 DeepSeek 在文本能力之外,向多模态方向迈出的实质性一步。

DeepSeek 发布了名为 deepseek-v4-flash-vision-exp 的实验性视觉模型,它能直接读取图片中的文字、图表和画面内容,并通过标准 OpenAI 兼容接口调用。这是 DeepSeek 在文本能力之外,向多模态方向迈出的实质性一步。

微软正在把 Windows 11 的任务管理器扩展为 AI 硬件监控工具,支持查看每个进程对 NPU 和 GPU 神经网络引擎的占用情况。这意味着本地 AI 推理将从一个“黑箱”操作,变成用户可以主动观察和管理的系统级资源。

DeepSeek 发布了一款名为 DeepSeek-v4-flash-vision-exp 的实验性视觉模型,其 API 定价将每张图像的 Token 消耗上限锁定在 384,约合每美元处理 2500 张图。这一价格策略显著降低了多模态应用的门槛,但也暴露出高分辨率细节识别的潜在短板。

据彭博社报道,Meta 每年向微软支付数亿美元,通过 Azure 云服务调用 OpenAI 等第三方 AI 模型,用于测试自家大模型的性能。与此同时,Meta 正在自建 API 服务,未来可能与微软 Foundry 形成直接竞争。

Waymo 已为旗下自动驾驶出租车自研了一款算力超过 1000 TOPS 的定制芯片,并已在新一代车型上投入使用,目的是降低对 Nvidia 和 AMD 芯片的依赖。

Product Hunt 上出现了一款名为《The 400 AI Playbook》的付费指南类产品,试图系统化梳理 AI 工具与工作流。在当前大模型与 AI 应用持续膨胀的环境下,这类“方法论型”产品开始填补工具清单与落地实践之间的空白。

巴西政府计划投入约4.44亿美元,分别采用中国华为与美国英伟达两套技术路线建造两台AI超级计算机,以规避对单一供应国的依赖。这是拉美国家首次在主权AI算力上做出如此明确的“双向押注”。

TechRadar 援引 Vasion 首席技术官 Corey Ercanbrack 的观点指出,英国企业 AI 采用率虽在增长,但多数组织仍把技术选型当作首要问题;真正决定 AI 转型成败的是组织内的人——如何管理 AI、如何培训员工、如何重构协作流程。

Meta 开源了一款名为 Muse Glimmer 的 300 亿参数智能体模型,通过量化技术将内存占用压缩到约 17-20 GB,让具备 24 GB 显存的消费级 GPU 也能本地运行多模态 AI 智能体,并支持工具调用与故障恢复。

科大讯飞在 2026 年半年度业绩说明会上披露,将于今年全球 1024 开发者节正式发布新款主力通用大模型,该模型基于全国产算力训练,且提前到 8 月底先推出阶段性版本。这是国产大模型在自主算力路线上的一次重要节点。