标签: 算力

《人人都能看懂 AI》 第三篇:Transformer——AI 为什么能理解上下文? 上一篇我们讲了 Embedding (嵌入)! Token (令牌 )是语言积木。 Embedding 则把每块积木放到了 AI 的“数学地图”上。 但还有一个巨大的问题: AI 怎么知道这些词放在一起,到底是什么意思? 比如:苹果很好吃; 和 苹果发布了一款新手机。 都有“苹果”。但第一个苹果是水果,第二个苹果是 Apple。如果 AI 只看一个个…

《人人都能看懂 AI》 第三篇:Transformer——AI 为什么能理解上下文? 上一篇我们讲了 Embedding (嵌入)! Token (令牌 )是语言积木。 Embedding 则把每块积木放到了 AI 的“数学地图”上。 但还有一个巨大的问题: AI 怎么知道这些词放在一起,到底是什么意思? 比如:苹果很好吃; 和 苹果发布了一款新手机。 都有“苹果”。但第一个苹果是水果,第二个苹果是 Apple。如果 AI 只看一个个…

AI 科普账号 @TheAI0bserver 发布《人人都能看懂 AI》系列第三篇,用“会场聚光灯”的比喻解释 Transformer 与 Attention(注意力机制)如何让 AI 结合上下文理解词语含义。这篇科普把 Token、Embedding、Transformer 三者的关系串成了一条完整的技术链…

Token危机已至:各大公司竞相削减AI开支

Token危机已至:各大公司竞相削减AI开支

企业AI应用正在从“鼓励多用”转向“限制乱用”。埃森哲内部会议泄露音频显示,非技术员工大量消耗AI token处理PDF转PPT等低价值任务,导致token开支飙升;Uber也因四个月烧光全年AI预算而紧急封顶员工使用权限。

再也不要花钱,Minimax H3把 AI 短片流程搬到本地,一个 agent 导演,三条本地管线工人详细教程

再也不要花钱,Minimax H3把 AI 短片流程搬到本地,一个 agent 导演,三条本地管线工人详细教程

一位创作者用仅 8GB 显存的 RTX 5070 Laptop 笔记本,把 AI 短片的出图、出视频、配音全流程搬到了本地,核心是“agent 导演 + 本地模型工人”的分工架构。它说明社区流传的“视频模型最低 12GB 显存”门槛并非绝对,量化模型和更聪明的工作流正在降低本地 AI 视频的门槛。

DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731

DeepSeek 于 7 月 31 日发布 V4 Flash 0731 模型,在 ARC-AGI-1 Semi-Private 评测中拿到 89.0% 准确率,单任务推理成本仅 0.02 美元;在难度更高的 ARC-AGI-2 上达到 61.4%,单任务成本 0.04 美元。值得关注的不只是分数,而是“接近顶…

DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 以极低的推理价格冲击市场,正在让“低成本智能”成为现实——过去只有大预算团队才用得起的自动化场景,现在普通开发者也能负担。