MiniMax H3 团队 Reddit 被问爆:2K 要开源,图像模型在路上,Apache-2.0 也在考虑了

MiniMax H3 团队在 Reddit 首次系统回应开放权重后的关键问题:2K 模型确认开源、Sparse Attention 参考实现即将发布、官方低步数版本正在考虑,并首次证实正在从 H3 模型谱系派生专门的图像生成模型。

MiniMax H3 团队在 Reddit 首次系统回应开放权重后的关键问题:2K 模型确认开源、Sparse Attention 参考实现即将发布、官方低步数版本正在考虑,并首次证实正在从 H3 模型谱系派生专门的图像生成模型。

企业AI应用正在从“鼓励多用”转向“限制乱用”。埃森哲内部会议泄露音频显示,非技术员工大量消耗AI token处理PDF转PPT等低价值任务,导致token开支飙升;Uber也因四个月烧光全年AI预算而紧急封顶员工使用权限。

NVIDIA 展示了一条将 NeMo Retriever、托管 NIMs、LanceDB、重排序与有据生成组合起来的多模态 RAG 流水线,核心是把“能看图的检索增强生成”从实验室拼装推向更标准的企业级部署。

一位用户通过 Tailscale 虚拟局域网把 M2、M5 和 Windows 三台电脑组网,配合 SSH 让 Codex 跨设备调度任务,把闲置设备变成可分工的 AI 工作集群。这件事说明,个人 AI 工作流正在从“单机跑模型”走向“多机分布式协作”。

一位创作者用仅 8GB 显存的 RTX 5070 Laptop 笔记本,把 AI 短片的出图、出视频、配音全流程搬到了本地,核心是“agent 导演 + 本地模型工人”的分工架构。它说明社区流传的“视频模型最低 12GB 显存”门槛并非绝对,量化模型和更聪明的工作流正在降低本地 AI 视频的门槛。

DeepSeek 于 7 月 31 日发布 V4 Flash 0731 模型,在 ARC-AGI-1 Semi-Private 评测中拿到 89.0% 准确率,单任务推理成本仅 0.02 美元;在难度更高的 ARC-AGI-2 上达到 61.4%,单任务成本 0.04 美元。值得关注的不只是分数,而是“接近顶…

Cloudflare 发布了 Kitesurf,一个完全运行在其 Workers 平台上的“代理优先”浏览器,专为 AI 智能体设计,而非人类用户,目前已在 Browser Run 中免费开放 beta 测试。

DeepSeek V4 Flash 0731 以极低的推理价格冲击市场,正在让“低成本智能”成为现实——过去只有大预算团队才用得起的自动化场景,现在普通开发者也能负担。

效力Google近27年的AI灵魂人物Jeff Dean宣布离职,与另外三位顶级科学家共同创办新公司Discovery Loop,目标是让AI自动化科研与工程闭环。这是Google AI体系迄今最严重的一次人才流失。

迪士尼正在小范围测试 Disney+ 的 AI 搜索功能,用户可以通过自然语言或语音提问,获得一个定制化的影视推荐栏目;同时 ESPN 也推出了更接近聊天机器人形态的 AI 问答搜索。这是流媒体平台在 AI 推荐赛道上的又一次加码。