互联网公司AI Token策略急转弯:从无限狂欢到月度限额背后的恐惧
从无限额狂欢到精打细算,互联网公司的 AI Token 策略正经历一场剧烈的回调。腾讯、字节等大厂纷纷把原本统一分配的大额额度替换为按任务动态调配,而一批中小公司则直接砍至人均 500 美元。这场由 Token-maxxing(把 Token 用量拉到极限)驱动的表面繁荣,正被天价账单和效率质疑刺破。
6 月 5 日,腾讯在内部宣布了 AI Token 额度的调整新政。最核心的变化是,过去面向全部员工的固定套餐,现在改成了基于工作任务动态调配的方式。内部通知明确表示,总体投入不会减少,但对能够通过 AI 带来显著提效和价值产出的同学,会确保 Token 额度;不再搞 Token 消耗量排名,也不贩卖焦虑。
但大厂们对 Token 消耗速度的预估仍远远不够。今年 4 月,Uber 首席技术官普拉文·纳加(Praveen Naga)就透露,他们在 4 个月内就用光了 2026 年全年的 AI 预算,而 Uber 2025 年的研发支出高达 34 亿美元。Meta 员工则在 30 天内烧掉 60.2 万亿个 AI token,成本突破 1 亿美元。
国内的情况一样触目惊心。5 月 20 日,《崩坏》系列 AI NPC 与 Gameplay 技术团队负责人郑银河公开表示,有同事为了推进项目,一次性搭建了几十个 Agent 协同工作,结果一个晚上就消耗掉价值 200 万元的 Token。
曾经,为了推行 AI 战略,不少公司鼓励员工最大程度调用 AI 工具,甚至把 Token 用量排名当作晋升和加薪的参考指标。但当拿到那张天文数字般的 Token 账单时,互联网公司们才幡然醒悟。
01 三天用掉九成额度,大厂壮士断腕式砍预算
腾讯这次的 Token 额度调整来得毫无预兆,让一部分员工措手不及。一位腾讯研发人员说,自己根本不够用,从通知下发的当天,他就发现额度只剩 10%,“用 Claude 的话根本扛不住,烧得太快了。”
Tech 星球了解到的信息显示,此次调整覆盖了实习生、外包人员和正式员工在内的所有角色,目前只有混元大模型对全员免费开放。在一些人看来,这几乎是必然的结果。一位腾讯员工的评论直白地写道:“用脚指头想也知道,怎么可能长期超额不限量供应。”
一位在腾讯从事大数据方向的外包员工告诉我们,过去他们使用大模型是积分制,手里有 10 万积分,基本没关注过具体 Token 量,但足够一个月使用。现在外包人员只能申请混元大模型,而混元没有 Token 限制。
然而,混元在基础大模型中的表现并不突出。虽然 Hy3 preview 凭借“强推理+256K 超长上下文”的能力曾连续登顶 OpenRouter 全球周榜,但在整体能力,尤其是编程等复杂任务上,Hy3 与 DeepSeek V4 Flash、Claude Sonnet 4.6 等模型之间依然存在明显差距。
而且,不同事业部、不同岗位的人对 Token 调整的感受差异很大。有人只剩 100 美元,有人手中却有上万元人民币。
一位腾讯实习生分享,调整前他的额度只有 100 美元,调整后换算下来约等于 200 美元,市面上先进的模型都可以用,但 200 美元确实不够,写代码多的时候一天就能花掉 50 美元。而一位腾讯 AI 预研游戏业务的员工则表示,自己目前还有 12600 元,同组同事则有 2.1 万元。也有不少人反映,自己的 Token 直接被砍了一半。
一位腾讯后端研发人员说,尽管整体额度有所缩减,但他所在的组基本不受影响,不够了就可以向上级申请。
此前曾有消息传出,腾讯为每位员工发放了价值约 22 万元的 Token 套餐。以腾讯集团 2026 年 Q1 财报公布的 114848 名员工计算,每年需要支付 252 亿元费用。作为对比,其 2025 年的研发费用是 857.5 亿元。
可现在,就算是财力雄厚的腾讯,也要开始精算细账了。这只是一幅行业缩影。Tech 星球了解到,国内主流大厂都会要求员工优先使用内部大模型,内部模型对员工基本免费,有的公司甚至还屏蔽了竞对的模型。然而,内部模型产出的效果,最终还是可能不敌海外模型。
一位字节跳动的员工介绍,公司内部并不强制使用 AI,“Token 额度对大厂是很大的负担,不同岗位、不同部门的额度本来就有差异,而且在字节,如果 AI 相关的技术研发岗位额度不够,还可以走内部审批,到外部单独采购。”他补充道。
一位美团员工表示,并没有听说内部有额度限制,而且自己的额度完全够用。而一位百度员工则称,不同部门的额度限制情况也存在差异。
02 打破 Token 盲目崇拜,小公司已率先扛不住
大厂或许还在犹豫要不要果断削减 Token 额度,但更多中小型互联网公司已经撑不下去了。
广州一家做跨境支付的企业决定大幅压缩员工的 Token 用量:从此前的上不封顶,降到人均每月 500 美元。而就在此前一个月,这家公司消耗了 40 万美元的 Token。
“这完全不够用。”上述公司的一位程序员告诉我们。他所在的公司甚至出现了互相借 Token 的现象,比如一位后端开发者 2 天就消耗掉 370 美元的额度,额度报警后,只好开始向同事借 Token。
此前,大大小小的互联网公司拼命践行 Token-maxxing,唯恐自己被 AI 浪潮抛下。于是,员工们挖空心思研究怎么把 Token 用到极致。一位员工分享道,尤其是后端程序员,研发了各种封装包、skill,每个业务都有一堆提效工具,一些程序员一开就是好几个 agent,一个小时就能烧掉上亿 Token。结果,新规发布前,有的程序员已经超出预算 1000 多美元。消耗 1 亿 Token,如果按照目前编程主流使用的 Claude Sonnet 4.6 来算,费用至少 2000 元,最高甚至接近 1 万元。
Token 浪费的现象也真实存在。一位新能源汽车领域的员工称,公司每月给他 1000 美元的 Token 额度,他却根本用不完,为了消化额度,只能用 AI 写原创小说,比如续写《红楼梦》。
上海某老牌互联网公司的员工告诉 Tech 星球,以前公司是完全不限制的,可现在公司开始统一管理每个人的 Token 额度,所有人都需要走钉钉审批流程才能申请 Token,每个人的额度从几百元到 1000 元不等。
类似的情况正在变得越来越普遍。北京一家腰部互联网公司的员工说,原来大家可以不限额使用 Claude Code,公司直接报销;现在开放了 Anthropic 的 API 接口,每人每月 1000 元额度,并且要求大家优先使用更便宜的国产大模型。
而现实是,便宜的大模型只能应付一些简单的代码补全任务,一旦碰到复杂任务,需要多轮反复交互,效果甚至不如自己手写。“我现在都开始自己掏钱买额度了,1000 元的额度可能根本撑不了一周。”
还有一些公司要求全面 AI 化,这进一步推动了 Token 用量的大幅上升。广州某游戏公司的员工说,之前 Token 全员免费,自己一个月用了近 3 万 Token,整个部门几乎人人超标,之后就只能用 DeepSeek 的模型了。
上海一位程序员在社交平台分享道,自己所在的部门只有 4 个人,可一个月就消耗掉了 6 万元的 Token。现在技术负责人直接采买了 DeepSeek 的 Token,要求整个技术团队切换过去。
Token-maxxing 带来的另一个后果是,在复盘时,不少程序员发现自己根本看不懂当时生成的代码,甚至连代码的位置和编写理由都说不清。管理层也发现,即便引入了 AI,整体的运营效率并没有明显提升,甚至当大模型需要排队时,反而拖累了重要产品的节奏。
百度创始人李彦宏在今年的 AI 开发者大会上首次提出“日活智能体数”(Daily Active Agents,简称 DAA)。DAA 大致对应移动互联网时代的日活用户数(DAU),看起来比单纯盯住 Token 消耗量更能反映平台和生态的真实繁荣程度。
从不设上限的肆意挥霍,到如今务实的“配额制”与“国产替代”,互联网公司对 AI 的盲目崇拜,正在经历一场不可回避的祛魅。