美食

AI大厂Token补贴战打响 多模型切换成用户自由选择常态

来源:快线潮资讯
AI大厂Token补贴战打响 多模型切换成用户自由选择常态

文 | 字母AI

过去两个月,AI圈子里突然刮起了一阵“发券”风。

北京时间7月31日,OpenAI官宣下调GPT-5.6 Luna的API价格,降幅高达80%;Terra模型降价20%。这意味着,在Codex和ChatGPT Work里调用这两款模型时,消耗的额度也相应缩水。

一时间,Token仿佛变成了电商大促里的优惠券。它既能当新品尝鲜券,也能做系统故障后的补偿金;既被打包进会员套餐,又被分成了“中杯、大杯、超大杯”,额度告急后还得再续一杯。

这场景,像极了外卖平台上那场轰轰烈烈的“奶茶大战”。平台争相撒券,看似让用户占了便宜,实则是在抢夺用户的消费习惯。

以前,AI公司的战场主要在参数规模、榜单排名和模型发布会这些硬核指标上。但随着Agent用户激增、各模型间性能差距缩小、以及迁移成本大幅降低,技术实力已经不再是唯一的壁垒,而只是一张入场券。

现在,AI公司必须直面一个更赤裸的问题:当用户可以无缝切换不同AI工具时,凭什么让他留下来?

**AI公司开始“发券”了**

这波Token促销潮中,有一个标志性节点出现在5月20日前后。

当时,OpenAI向YC孵化器的创业公司抛出了橄榄枝:每家公司最高可得200万美元的Token额度,条件是出让部分股权。

OpenAI此举相当于用自家算力入股,既押注了这些初创企业,又希望它们从起步阶段就绑定OpenAI模型,从而在未来转化为稳定的付费客户。

到了6月,Token的性质更像电商平台的促销券。因系统异常导致Codex多扣额度后,OpenAI两次统一重置用户额度,还额外赠送了一次可留待日后使用的重置机会。

系统出Bug,就用额度来安抚用户,这相当于一张“免费续杯券”。

Anthropic走的则是另一条路。

Fable 5最初只开放一周免费体验,但活动连续延期两次,Claude Code周额度增加50%的活动也同步延长。7月20日起,Fable 5正式并入高阶套餐。原本用于新品推广的短期免费体验,最终演变成了一项长期会员权益。

DeepSeek的动作更为直接。

V4-Pro率先永久降价75%,以低价吸引开发者入局;6月底又提出采用峰谷定价策略,利用分时价格来调控使用量。MiniMax则将Token打包成20美元、50美元和120美元三档套餐,对应不同用量,简直就像奶茶店菜单上的小杯、中杯和大杯。

如今,OpenAI也加入了这场降价混战。就在7月的最后一天,OpenAI宣布GPT-5.6 Luna的API输入和输出价格均下调80%,目前每百万Token分别仅需0.2美元和1.2美元;Terra下调20%,降至2美元和12美元。虽然Codex和ChatGPT Work的订阅价格及总额度未变,但使用Luna和Terra时会少扣额度。旗舰模型Sol则维持原价不动。

这场“Token奶茶大战”不仅局限于个人会员套餐,对高价值企业客户,厂商的赠送更是毫不手软。据《华尔街日报》报道,AI客服平台Pylon的CEO透露,今年公司已从一家模型供应商处获赠约160万美元的免费Token,另外两家也分别提供了数万美元额度,更有甚者提供数月无限量免费使用权。

模型降价和赠送额度并非新鲜事。

但在过去,这类操作通常集中在新品发布期,或是作为开发者扶持手段,热闹一阵便戛然而止。而最近两个月,送Token的花样层出不穷,Token不仅开始承担类似优惠券的功能,被系统地用于拉新、留存和补偿,更成了争抢企业客户的投标筹码。

无论厂商如何包装这一行为,都指向同一事实:AI公司已不满足于传统的按量计价模式,而是开始用更“互联网化”的手段争夺用户。

这背后的痛点在于,单一的订阅制越来越难以覆盖差异巨大的使用强度。

轻度用户看重低门槛,重度用户则在执行长任务时饱受额度焦虑之苦。于是,会员档位、流量包、Credits积分以及峰谷定价应运而生。AI公司不再只是卖模型,也开始钻研消费巨头们早已熟稔的商业逻辑——怎么让用户完成第一次下单,之后用什么方式诱导TA多买一杯,以及在喝完后给TA一个回头的理由。

AI公司的战场并未脱离技术竞赛,却明显多了一层商业化的博弈。

或者用更互联网的话说:得留存者得天下。

**模型越来越像,用户越来越花心**

厂商突然在Token上重金加码,背后有两个关键变化:一是Agent用户迅速增加,单个用户消耗的额度越来越高;二是头部模型在许多常用任务上的差距正在缩小,用户换平台的阻力变小。因此,价格、额度和会员权益成了争夺用户习惯的关键抓手。

首先,AI用户仍在快速涌入。

截止6月初,Codex每周活跃用户已突破500万,是2月桌面应用推出时的6倍以上。

更值得关注的是,其中非开发者占比约20%,增速超过开发者的3倍。编程Agent的用途已超越单纯的写代码,整理资料、撰写文档和分析数据也成了常见用法,甚至有人会将全流程任务交给它处理。

用户消耗Token的方式也在改变。根据OpenAI官方数据,到今年5月,80.6%的Codex个人用户至少提交过一次相当于人类工作30分钟以上的任务,25.6%提交过相当于8小时以上的任务,超过10%的用户每周同时管理过3个以上Agent。

过去,用户向聊天机器人提问并获取答案,流程简单且Token消耗量相对较小。现在,Agent的一项任务可能持续数小时。Token的消耗从“2G时代”突然跃升至“5G时代”,旧的额度体系显然捉襟见肘。

Anthropic对约40万次Claude Code会话的分析也印证了这一点:用户平均每周使用约20小时。2025年10月至2026年4月期间,用它写文档和分析数据的会话占比从约10%翻倍至20%,平均任务价值提高了27%。

随着Agent从偶尔尝鲜转变为进入日常工作流,额度已从附赠福利变为刚需。

厂商开始全力争夺那些使用频率高、付费周期长的用户。截止今年2月,Claude Code年化收入已超过25亿美元,较年初翻倍,企业订阅数量增长4倍,企业客户贡献了超过一半的收入。

谁能促使这批用户更频繁地使用Agent,谁就可能获得持续增长的Token收入。

问题是,这些用户并不忠诚。

AI客服平台Pylon的CEO对此直言不讳:“我完全看不到任何忠诚度。”

过去购买传统软件、选定一家并持续付费的时代已成历史。如今,企业通常会同时接入几家模型,具体任务交给哪家,主要取决于效果和价格。

Cursor的产品本质上是“与模型无关”的,用户可以在OpenAI、Anthropic、Google和开源模型之间自由切换。其负责人称,过去一项任务的最佳模型可能几个月才变一次,现在每周都可能更换好几次。

这也解释了厂商为何急着多送Token。

Agent用户正在快速增长,但多数人的使用习惯尚未定型,企业也未决定最终将哪家模型接入业务。厂商争夺的是,谁先成为个人用户的常用工具,以及企业工作流中的默认模型。

2026年,的里雅斯特大学、伦敦国王学院和伦敦大学学院的研究者分析了7156个由编程Agent生成的GitHub拉取请求,结果显示没有任何一个工具能在所有任务中领先。很多时候,任务类型带来的差距,比工具之间的差距还要大。

对用户而言,最好的模型越来越像一道动态选择题。

迁移也变得愈发容易。

DeepSeek同时提供OpenAI和Anthropic兼容接口,MiniMax的Token套餐可以直接接入Claude Code、Cline和OpenClaw。

开发者甚至无需改变原有的工作界面,只需更换底层模型,就能将任务转走。

AI公司愿意进行Token补贴,争夺的是用户的长期工作流。一旦模型嵌入企业系统,更换成本就会迅速攀升,AI产品的护城河由此建立。因此,早期的补贴具有明显的入口争夺意义。

模型能力负责把人吸引过来,补贴则负责给用户一个“先别走”的理由。

**技术只是入场券,AI公司开始补商业课**

但Token优惠和“奶茶券”有一个根本区别:奶茶多送一杯,成本相对清晰可控。但Token多送一亿,最后会转化成多少算力支出,很难提前算清。

而在当下,算力依然非常、非常珍贵。

于是,出现了一种有趣的景象——AI公司一边发券,一边限流。

5月6日,Anthropic宣布与SpaceX达成算力合作,Claude Code的5小时额度才得以翻倍,高峰期也不再下调限额。Fable 5恢复后,最多只能占付费用户周额度的50%,超出部分需购买Credits。免费体验从一开始就画好了成本边界。

MiniMax的大额套餐同样不是无限使用。它同时设置了5小时额度、周额度、Agent并发上限和高峰期限流,并建议生产环境使用按量付费。

OpenAI此次降价同样保留了清晰的成本边界。ChatGPT和Codex的订阅价格及额度总量没有变化,只是使用Luna和Terra时扣除的额度减少。旗舰模型Sol价格未动,API新推出的Fast模式则以两倍标准价格换取最高2.5倍的速度。

OpenAI的多款Agent产品仍然共用额度池,复杂任务消耗更多。额度用完后,用户只能购买Credits、重置额度、升级套餐,或者等下一周期恢复。

Token不能无限发放,用户又随时可能迁移,厂商只能将适用的人群、模型和时间切分得越来越细。

Anthropic用Pro、Max等档位区分额度,Max内部又分为5倍和20倍用量,达到上限后还能继续购买Credits。DeepSeek把V4拆成Flash和Pro两档,对缓存命中、普通输入和输出分别收费,高峰时段价格还会翻倍。

模型厂商开始分层定价,企业也开始分层使用。

更棘手的是,补贴能带来拉新,却很难买来忠诚。

厂商希望用免费Token换来长期调用,但企业也在迅速学会“薅完就走”。Pylon一边从多家供应商手里领取免费额度,一边明确表示看不到任何忠诚度。Cursor、Zoom和Hex则把多个模型同时接入工作流,随时根据价格和效果重新分配任务。

厂商想把用户锁进一个生态,企业却在努力不被任何一家锁定。

微软对数万名工程师的研究发现,编程Agent的第一次使用往往由同事带动,但后续是否持续使用,主要取决于工程师是否真的有足够的编程需求,持续使用者合并的PR数量提高约24%。真正能留下用户的,仍然是产品能否融入日常工作。

换句话说,优惠券只能把奶茶送到用户手里,不能保证他从此每天都喝。

AI公司接下来要同时做两门生意:一边像消费平台一样用补贴做拉新和留存;一边像云厂商一样调配算力并守住毛利。

既怕用户跑,又怕用户用得太多,实在是一种别扭的处境。

Token越送越多,用户却未必留下。用户真留下来,算力账单又会跟着上涨。最棘手的是,调用量和成本可以一起增长,收入却未必跟得上。

优惠总会结束。等到各家不再靠送额度拉人,还能留住用户并把这门生意做下去的,究竟是谁?

相关推荐

最新文章