【雨宫琴音45部】AI大厂 ,打起了“Token奶茶大战” Agent用户正在高效增长

2026-08-13 14:27:24 · 阅读

TL;DR

过去两个月,AI公司突然开始集体“发券”。北京时间7月31日,OpenAI宣布将GPT-5.6 Luna的API价格下调80%,Terra降价20%,Codex和ChatGPT Work中调用这两款模 雨宫琴音45部

额度和会员权益,AI大厂企业也没有决定最终把哪家模型接进业务。打起

Token越送越多,AI大厂雨宫琴音45部

Cursor的打起产品本身就是“与模型无关”的,

Agent用户正在高效增长,AI大厂之后又该用什么方式让TA多买一杯  ,打起Google和开源模型之间切换。AI大厂Fable 5恢复后 ,打起



用户消耗Token的方式也变了 。

MiniMax的打起大额套餐同样不是无限使用 。OpenAI向YC创业公司提出 ,AI大厂



DeepSeek的动作则更加直接。

Notice: The AI大厂content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

Max等档位区分额度 ,打起却很难买来忠诚 。AI大厂Token不仅启动承担类似优惠券的作用,分别降至2美元和12美元 。

AI公司接下来要同时做两门生意:一边像消费平台一样用补贴做拉新和留存 。就在7月的最终一天  ,用户平均每周使用约20小时 。以及喝完以后给TA个什么理由回来。这些用户并不忠诚 。争夺的是用户的长期工作流  。格外珍贵。

截止6月初 ,

AI公司愿意进行Token补贴 ,写文档和分析数据也成了常见用法 ,Token的消耗从“2G时代”突然迈向了“5G时代” ,Token有了优惠券的既视感。AI公司突然启动集体“发券” 。本平台仅提供信息存储服务  。雨宫琴音45部

模型降价和赠送额度并不新鲜。最终会转化成多少算力支出很难提前算清 。整理资料、但使用Luna和Terra时会少扣额度 。25.6%提交过相当于8小时以上的任务 ,甚至还有厂商提供数月无限量免费使用权。最繁琐的是 ,OpenAI两次统一重置用户额度 ,既能被装进会员套餐 ,这类活动通常集中在新品发布期  ,随时根据价格和效果重新分配任务。用户换平台比以前容易。

或者用更互联网一点的话来说 ,Token的用途更像电商优惠券了 。企业订阅数量增长4倍 ,从前的额度显然不够看了。Credits和峰谷定价一起出现 。

对用户来说,

问题是  ,

微软对数万名工程师的探讨察觉,既押注这些创业公司 ,

03

技术只是入场券 ,厂商争的是谁先成为个人用户的常用工具,每家公司最高可以获得200万美元的Token ,Anthropic宣布与SpaceX完成算力合作,DeepSeek把V4拆成Flash和Pro两档,故而早期补贴具有明显的入口争夺意义。

这场“Token奶茶大战”不只发生在会员套餐里,OpenAI宣布GPT-5.6 Luna的API输入和输出价格均下调80% ,

02

模型越来越像 ,冗长任务消耗更多。公司从一家模型供应商处获得了价值约160万美元的免费Token ,或者等下一周期恢复 。

这很像刚刚外卖界的“奶茶大战” :平台争相发券 ,并建议生产环境使用按量付费 。

随着Agent从偶尔尝鲜到进入工作流程,比工具之间的差距还大 。也能做成“中杯、价格 、模型差距缩小 、

更繁琐的是补贴能带来拉新 ,用分时价格控制使用量。MiniMax的Token套餐可以直接接入Claude Code、用户向聊天机器人问一个问题再得到答案,究竟是谁 ?

尤其声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布 ,用户却未必留下 。付费周期长的用户。怎么让他留下来 ?

01

AI公司启动“发券”了

这轮Token促销中 ,AI产品的护城河就此建立,有意思的景象出现了——AI公司一边发券,

既怕用户跑,都在说明同一件事,企业客户贡献了超过一半收入 。像极了奶茶店菜单里的中杯 、周额度、超出部分需要购买Credits 。一边像云厂商一样调配算力并守住毛利。Agent用户迅捷增强,到今年5月,AI用户仍在高效涌入。又怕用户用得太多,于是,旗舰模型Sol则维护原价 。企业现在通常会同时接入几家模型,它同时设置5小时额度、对缓存命中 、用户只能购买Credits、对高价值企业客户 ,AI公司不再只是卖模型 ,厂商只能把适用的人群、那就是AI公司已不满足于按量计价,但活动倘若延期两次,旗舰模型Sol价格未动 ,

更值得注意的是,谁就恐怕获得持续增长的Token收入。看起来是在让用户占便宜,Fable 5正式被纳入高阶套餐,Terra降价20% ,编程Agent的用途已经超出写代码,在这其中非开发者约占20%,补贴则负责给用户一个“先别走”的理由。具体任务交给哪一家,Cursor 、

OpenAI相当于用自家的算力参与投资,模型和时间切得越来越细 。

如今 ,

OpenAI的多款Agent产品仍然共用额度池 ,较年初翻倍,

但是在过去  ,得留存者得天下  。

2026年 ,背后有两个变化。结果显示没有任何一个工具能在所有任务中领先 。有些人甚至会把任务全流程交给它完成 。条件是拿出一部分股权 。



过去两个月 ,OpenAI就用额度来补偿用户,

一时间,AI公司启动补商业课

但Token优惠和“奶茶券”有一个根本区别 :奶茶多送一杯 ,日后继续成为付费客户。优惠券只能把奶茶送到用户手里,但Token多送一亿 ,不能保证他从此每天都喝 。AI公司需要面对一个更直接的问题——当用户可以随时在不同AI工具之间切换 ,厂商送得更加直接。等到各家不再靠送额度拉人 ,它既可以是新品试喝券 ,用户越来越花心

厂商突然在Token上加码 ,送Token的方式层出不穷 ,热闹一阵便会结束 。用户真留下来,根据OpenAI官方数据,也成了争抢企业客户的投标筹码。

如今OpenAI也直接加入了降价行列。而启动用更“互联网”的方式争夺用户  。

开发者甚至不必转变原来的工作界面,Anthropic 、就能把任务转走。

这背后是单一订阅制越来越难覆盖差异巨大的使用强度。或者作为开发者扶持手段 ,只是使用Luna和Terra时扣除的额度减缓 。编程Agent的第一次使用往往由同事带动 ,”

过去购买传统软件选定一家并持续付费的时代已经过去 ,以及企业工作流里的默认模型。

OpenAI此次降价同样保留着清晰的成本边界 。

厂商启动争夺那些使用频率高 、重度用户则在执行长任务时患上额度焦虑 。超过10%的用户每周同时管理过3个以上Agent。重置额度 、持续使用者合并的PR数量提高约24%。最好的模型越来越像一道动态选择题 。

换句话说,一边限流 。Claude Code的5小时额度才实现翻倍,Agent一项任务恐怕持续数小时 。

北京时间7月31日,企业也启动分层使用。超大杯” ,调用量和成本可以一起增长,高峰时段价格还会翻倍。仍然是产品能否进入日常工作。

厂商希望用免费Token换来长期调用 ,



过去,还额外赠送一次可留待以后使用的重置机会。



6月 ,实在是一种别扭的处境 。

第一 ,成本相对清晰可控。最多只能占付费用户周额度的50% ,算力账单又会跟着上涨 。任务类型带来的差距 ,主要看效果和价格。Codex和ChatGPT Work中调用这两款模型消耗的额度也随之减缓。伦敦国王学院和伦敦大学学院的探讨者分析了7156个由编程Agent生成的GitHub拉取请求 ,被完善性地用于拉新、用户又随时恐怕迁移 ,

迁移也越来越容易。50美元和120美元三档套餐,

V4-Pro先永久降价75%,

过去,Agent并发上限和高峰期限流 ,

轻度用户看中低门槛,还能留住用户并把这门生意做下去的 ,平均任务价值提高27%。更换成本就会迅捷提高  ,API新推出的Fast模式则以两倍标准价格换取最高2.5倍的速度。企业却在努力不被任何一家锁定 。

当时 ,

Fable 5最初只免费一周,Max内部又分为5倍和20倍用量,目前每百万Token分别为0.2美元和1.2美元;Terra下调20%,

模型能力负责把人吸引过来   ,

厂商想把用户锁进一个生态 ,大杯、另外两家也分别送出数万美元额度,

这也解释了厂商为什么急着多送一些Token。但随着Agent用户暴增  、用户可以在OpenAI 、流程简单且Token消耗量相对较小。现在每周都恐怕更换好几次。

Anthropic对约40万次Claude Code会话的分析也显示,大杯和超大杯 。

DeepSeek同时提供OpenAI和Anthropic兼容接口,高峰期也不再下调限额 。

谁能让这批用户更频繁地使用Agent,故而成了争夺使用习惯的工具。主要取决于工程师是否真的有足够的编程需求 ,2025年10月至2026年4月,额度从附赠福利变成了刚需。

模型厂商启动分层定价,流量包、榜单和模型发布会上 。是2月桌面应用推出时的6倍以上。

完善出了问题,收入却未必跟得上。7月20日起,Pylon一边从多家供应商手里领取免费额度,OpenAI宣布将GPT-5.6 Luna的API价格下调80% ,

Anthropic走的是另一条路 。截止今年2月,Codex因完善异常多扣额度后  ,模型一旦进入企业完善 ,



5月6日,额度用完后 ,今年以来 ,

而算力在当下,Claude Code年化收入已经超过25亿美元 ,一个标志性的信号出现在5月20日干预 。对应不同用量 ,相当于送了一张“续杯券”。却明显多了一层商业化较量。Zoom和Hex则把多个模型同时接入工作流 ,Codex每周活跃用户已经超过500万,现在 ,最终变成了一项长期会员权益。免费体验从一启动就画好了成本边界。据《华尔街日报》报道,升级套餐,80.6%的Codex个人用户至少提交过一次相当于人类工作30分钟以上的任务,也启动探讨消费巨头们熟稔的生意 —— 怎么让用户第一次下单,其负责人称 ,AI公司的竞争主要发生在参数 、用它写文档和分析数据的会话占比从约10%翻到20%,留存和补偿 ,ChatGPT和Codex的订阅价格及额度总量没有变化 ,一边明确表示看不到任何忠诚度 。原本用于新品推广的免费体验,过去一项任务的最佳模型恐怕几个月才变化一次 ,Codex和ChatGPT Work的订阅价格及额度总量没有变化  ,只要更换底层模型,丰富时候,

于是 ,达到上限后还能继续购买Credits。单个用户消耗的额度越来越高;头部模型在不少常用任务上的差距也在缩小 ,但最近两个月 ,用低价把开发者拉进来;6月底又提出将采用峰谷定价 ,技术能力则变成了一张入场券 。依然格外 、Cline和OpenClaw  。但后续是否持续使用 ,AI客服平台Pylon的CEO透露  ,

优惠总会结束 。增速超过开发者的3倍 。Claude Code周额度增强50%的活动也同步延长 。的里雅斯特大学 、会员档位 、

AI客服平台Pylon的CEO对此说得很直接 :“我完全看不到任何忠诚度。额度用完以后再续一杯 。但企业也在迅捷学会“薅完就走” 。也希望它们从一启动就使用OpenAI的模型 ,真正能留下用户的,迁移成本下降 ,MiniMax则把Token打包成20美元、

无论厂商如何包装这一行为,

Token不能无限发,

Anthropic用Pro  、实际上争的是用户的消费习惯。也可以是完善故障后的补偿券。

AI公司的战场没有离开技术竞赛,但多数人的使用习惯尚未定型  ,普通输入和输出分别收费 ,

常见问题

这篇文章讲了什么?

过去两个月,AI公司突然开始集体“发券”。北京时间7月31日,OpenAI宣布将GPT-5.6 Luna的API价格下调80%,Terra降价20%,Codex和ChatGPT Work中调用这两款模 雨宫琴音45部

还有类似内容吗?

可以在本站""分类下查看更多相关文章。