标签: 算力

Token危机已至:各大公司竞相削减AI开支

Token危机已至:各大公司竞相削减AI开支

企业AI应用正在从“鼓励多用”转向“限制乱用”。埃森哲内部会议泄露音频显示,非技术员工大量消耗AI token处理PDF转PPT等低价值任务,导致token开支飙升;Uber也因四个月烧光全年AI预算而紧急封顶员工使用权限。

再也不要花钱,Minimax H3把 AI 短片流程搬到本地,一个 agent 导演,三条本地管线工人详细教程

再也不要花钱,Minimax H3把 AI 短片流程搬到本地,一个 agent 导演,三条本地管线工人详细教程

一位创作者用仅 8GB 显存的 RTX 5070 Laptop 笔记本,把 AI 短片的出图、出视频、配音全流程搬到了本地,核心是“agent 导演 + 本地模型工人”的分工架构。它说明社区流传的“视频模型最低 12GB 显存”门槛并非绝对,量化模型和更聪明的工作流正在降低本地 AI 视频的门槛。

DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731

DeepSeek 于 7 月 31 日发布 V4 Flash 0731 模型,在 ARC-AGI-1 Semi-Private 评测中拿到 89.0% 准确率,单任务推理成本仅 0.02 美元;在难度更高的 ARC-AGI-2 上达到 61.4%,单任务成本 0.04 美元。值得关注的不只是分数,而是“接近顶…

DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 以极低的推理价格冲击市场,正在让“低成本智能”成为现实——过去只有大预算团队才用得起的自动化场景,现在普通开发者也能负担。

Disney Plus 测试新的AI搜索功能

Disney Plus 测试新的AI搜索功能

迪士尼正在小范围测试 Disney+ 的 AI 搜索功能,用户可以通过自然语言或语音提问,获得一个定制化的影视推荐栏目;同时 ESPN 也推出了更接近聊天机器人形态的 AI 问答搜索。这是流媒体平台在 AI 推荐赛道上的又一次加码。