Token危机已至:各大公司竞相削减AI开支

企业AI应用正在从“鼓励多用”转向“限制乱用”。埃森哲内部会议泄露音频显示,非技术员工大量消耗AI token处理PDF转PPT等低价值任务,导致token开支飙升;Uber也因四个月烧光全年AI预算而紧急封顶员工使用权限。

一句话看懂:企业AI应用正在从“鼓励多用”转向“限制乱用”。埃森哲内部会议泄露音频显示,非技术员工大量消耗AI token处理PDF转PPT等低价值任务,导致token开支飙升;Uber也因四个月烧光全年AI预算而紧急封顶员工使用权限。

事件核心:发生了什么

据404 Media获得的埃森哲内部会议录音,这家咨询巨头正在研究如何阻止非技术员工将公司AI预算浪费在琐碎事务上。埃森哲代理AI战略负责人Justice Kwak在会议中透露,内部数据显示驱动token消耗的主要群体并非工程师,而是大量非工程岗位人员。这一现象并非孤例:Uber在鼓励全员使用AI后,CTO承认四个月就耗尽了全年AI预算,随后不得不对Claude Code、Cursor等工具设置使用上限。与此同时,GitHub等AI服务商正从包月订阅转向按token计费,使企业的AI支出从“固定成本”变成“弹性成本”,进一步放大了失控风险。

为什么重要

这打破了此前“超级工程师用AI生成海量代码”的叙事。实际推动算力消耗的可能是做PPT的咨询顾问、写邮件的市场人员这些非技术角色。更深层的变化在于,企业AI商业化正从“跑马圈地”进入“精打细算”阶段:当推理成本与token消耗挂钩,AI大模型在企业内部的角色就从“无限供给的生产力工具”变成了需要核算投入产出的IT资源。这也解释了为什么埃森哲一边要求资深员工必须使用AI否则影响晋升,一边又在限制token浪费——企业既要拥抱AI,又承受不起无节制使用的代价。

对用户/开发者/创作者的影响

对开发者而言,GitHub按token计费的变化意味着调用大模型API、使用AI编程助手时的成本将直接取决于代码量级和上下文长度,需要更关注提示词优化和模型选型。对普通用户和创作者来说,企业收缩AI使用权限可能导致部分免费或低价AI工具收紧配额、提高订阅价格;那些依赖AI完成文案、图片生成、PPT制作的个人创作者,也需要重新评估工具成本。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

目前公开信息显示,以下几个方向值得持续观察:第一,埃森哲最终会推出怎样的内部AI治理机制——是设置部门级预算、按任务分级授权,还是用更小更廉价的模型替代大模型处理简单任务;第二,Uber的封顶措施是否会被其他科技公司效仿,以及这种“用后即锁”的模式会否影响员工使用AI的积极性;第三,按token计费是否会成为AI服务商的主流商业模式,并推动一批面向企业场景的“省钱工具”出现。这些变化将直接影响AI产品定价和开发者的技术路线选择。

来源:Hacker News · 24h最热

celebrityanime
celebrityanime
文章: 18313

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注