DeepSeek 发布 V4.1-Flash,大幅降低 AI Agent 的 KV cache 内存需求

DeepSeek 发布多模态模型 V4.1-Flash,主打压缩 AI Agent 场景下的 KV cache 内存占用,据官方技术报告,快速显存中的缓存需求降至上一代的约四分之一,编码端算力需求近乎减半,模型以 MIT 协议开源。

DeepSeek 发布多模态模型 V4.1-Flash,主打压缩 AI Agent 场景下的 KV cache 内存占用,据官方技术报告,快速显存中的缓存需求降至上一代的约四分之一,编码端算力需求近乎减半,模型以 MIT 协议开源。

硅基流动(SiliconFlow)在 DeepSeek 发布当天就上线了 DeepSeek-V4.1-Flash,这是一款 552B 参数的 MoE 模型,支持原生视觉和 1M 上下文,并以约 8B/16B 的激活参数实现高吞吐推理。

2026外滩大会9月10日在上海开幕,主题定为“创造AI新经济”。讨论焦点已从模型能力转向Agent能否真正参与交易、协作和生产,蚂蚁、OPPO、万事达卡等公司披露了Agent消费与商业信任的最新进展。

蚂蚁旗下健康 AI 应用阿福发起“科学减重 100 亿斤”活动两个月,275 万网友累计减重超 500 万斤;体重管理正从个人自律变成 AI 硬件与健康消费的入口。

该问题通常出现在 Windows 上用一键安装脚本部署 TextGen WebUI 时,安装流程虽然没报错,但实际装成了 CPU 版 PyTorch,导致启动后无法调用 GPU。优先确认 PyTorch 是否为 CUDA 版、CUDA 是否真实可用,再考虑换用官方推荐的 WSL 安装方式。

欧盟网络安全机构 ENISA 已获得 Anthropic 的 Mythos 5 使用权限,并正在同步测试 OpenAI 的 GPT-6 Astra,这是欧盟《人工智能法案》生效后,监管机构首次对具备进攻性网络能力的前沿大模型进行实际评估。

DeepSeek 发布 DeepSeek-V4.1-Flash,这是其目前最小的模型,采用全新的因果编码器-解码器(Causal Encoder-Decoder)架构,主干参数 552B,支持 100 万 token 上下文。值得关注的是“最小”与“552B 参数”“1M 上下文”同时出现,说明 DeepSe…

KB Securities 最新报告判断,内存芯片市场可能在 2027 年走向严重供应短缺,三星和 SK 海力士的内存库存已降至不足 10 天,而 AI 基础设施建设是主要推手。

以空气炸锅闻名的 Cosori 推出了一款 299.99 美元的滴滤咖啡机 Juni,用机械结构模拟手冲咖啡师的注水动作,并用 AI 扫描咖啡豆包装自动生成冲泡参数。这是 AI 从"生成内容"走向"控制物理设备"的一个具体案例。

据南华早报报道,月之暗面(Moonshot AI)正在评估在香港和上海两地上市的可能性,目的是获取更多资金与市场曝光;这一动向出现在港股 AI 板块表现疲弱的背景下。