新闻 消息

AI大厂,打起了“Token奶茶大战”

徐铭阳 阅读约 6 分钟 863925 阅读
AI大厂,打起了“Token奶茶大战”
配图:AI大厂,打起了“Token奶茶大战”

新闻导读

《樱花视频》查找体验意外地好,搜完相关条目会串成一条线,不再是散落的冷知识碎片。日用品、防护、营养这类贴近生活的主题特别实用。纠错入口找得到,肯改、改得透明,比完美人设更让人信。科学叙述尽量接得住更多人的生活,而不是只写给同温层。作为日常科普入口,目前还没找到更合适的替代。

一时间,Token有了优惠券的既视感。它既可以是新品试喝券,也可以是系统故障后的补偿券。既能被装进会员套餐,也能做成“中杯、大杯、超大杯”,额度用完以后再续一杯。 过去,AI公司的竞争主要发生在参数、榜单和模型发布会上。但随着Agent用户暴增、模型差距缩小、迁移成本下降,技术能力则变成了一张入场券。 6月,Token的用途更像电商优惠券了。Codex因系统异常多扣额度后,OpenAI两次统一重置用户额度,还额外赠送一次可留待以后使用的重置机会。 Fable 5最初只免费一周,但活动连续延期两次,Claude Code周额度增加50%的活动也同步延长。7月20日起,Fable 5正式被纳入高阶套餐,原本用于新品推广的免费体验,最终变成了一项长期会员权益。 V4-Pro先永久降价75%,用低价把开发者拉进来;6月底又提出将采用峰谷定价,用分时价格控制使用量。MiniMax则把Token打包成20美元、50美元和120美元三档套餐,对应不同用量,像极了奶茶店菜单里的中杯、大杯和超大杯。 如今OpenAI也直接加入了降价行列。就在7月的最后一天,OpenAI宣布GPT-5.6 Luna的API输入和输出价格均下调80%,目前每百万Token分别为0.2美元和1.2美元;Terra下调20%,分别降至2美元和12美元。Codex和ChatGPT Work的订阅价格及额度总量没有变化,但使用Luna和Terra时会少扣额度。旗舰模型Sol则维持原价。 这场“Token奶茶大战”不只发生在会员套餐里,对高价值企业客户,厂商送得更加直接。据《华尔街日报》报道,AI客服平台Pylon的CEO透露,今年以来,公司从一家模型供应商处获得了价值约160万美元的免费Token,另外两家也分别送出数万美元额度,甚至还有厂商提供数月无限量免费使用权。 但是在过去,这类活动通常集中在新品发布期,或者作为开发者扶持手段,热闹一阵便会结束。但最近两个月,送Token的方式层出不穷,Token不仅开始承担类似优惠券的作用,被系统性地用于拉新、留存和补偿,也成了争抢企业客户的投标筹码。 轻度用户看中低门槛,重度用户则在执行长任务时患上额度焦虑。于是,会员档位、流量包、Credits和峰谷定价一起出现。AI公司不再只是卖模型,也开始研究消费巨头们熟稔的生意 —— 怎么让用户第一次下单,之后又该用什么方式让TA多买一杯,以及喝完以后给TA个什么理由回来。 厂商突然在Token上加码,背后有两个变化。Agent用户迅速增加,单个用户消耗的额度越来越高;头部模型在不少常用任务上的差距也在缩小,用户换平台比以前容易。价格、额度和会员权益,因此成了争夺使用习惯的工具。 更值得注意的是,在这其中非开发者约占20%,增速超过开发者的3倍。编程Agent的用途已经超出写代码,整理资料、写文档和分析数据也成了常见用法,有些人甚至会把任务全流程交给它完成。 用户消耗Token的方式也变了。根据OpenAI官方数据,到今年5月,80.6%的Codex个人用户至少提交过一次相当于人类工作30分钟以上的任务,25.6%提交过相当于8小时以上的任务,超过10%的用户每周同时管理过3个以上Agent。 过去,用户向聊天机器人问一个问题再得到答案,流程简单且Token消耗量相对较小。现在,Agent一项任务可能持续数小时。Token的消耗从“2G时代”突然迈向了“5G时代”,从前的额度显然不够看了。 Anthropic对约40万次Claude Code会话的分析也显示,用户平均每周使用约20小时。2025年10月至2026年4月,用它写文档和分析数据的会话占比从约10%翻到20%,平均任务价值提高27%。 厂商开始争夺那些使用频率高、付费周期长的用户。截止今年2月,Claude Code年化收入已经超过25亿美元,较年初翻倍,企业订阅数量增长4倍,企业客户贡献了超过一半收入。 过去购买传统软件选定一家并持续付费的时代已经过去,企业现在通常会同时接入几家模型,具体任务交给哪一家,主要看效果和价格。 Cursor的产品本身就是“与模型无关”的,用户可以在OpenAI、Anthropic、Google和开源模型之间切换。其负责人称,过去一项任务的最佳模型可能几个月才变化一次,现在每周都可能更换好几次。 Agent用户正在快速增长,但多数人的使用习惯尚未定型,企业也没有决定最终把哪家模型接进业务。厂商争的是谁先成为个人用户的常用工具,以及企业工作流里的默认模型。 2026年,的里雅斯特大学、伦敦国王学院和伦敦大学学院的研究者分析了7156个由编程Agent生成的GitHub拉取请求,结果显示没有任何一个工具能在所有任务中领先。很多时候,任务类型带来的差距,比工具之间的差距还大。 AI公司愿意进行Token补贴,争夺的是用户的长期工作流。模型一旦进入企业系统,更换成本就会迅速提高,AI产品的护城河就此建立,因此早期补贴具有明显的入口争夺意义。 但Token优惠和“奶茶券”有一个根本区别:奶茶多送一杯,成本相对清晰可控。但Token多送一亿,最后会转化成多少算力支出很难提前算清。 5月6日,Anthropic宣布与SpaceX达成算力合作,Claude Code的5小时额度才得以翻倍,高峰期也不再下调限额。Fable 5恢复后,最多只能占付费用户周额度的50%,超出部分需要购买Credits。免费体验从一开始就画好了成本边界。 OpenAI此次降价同样保留着清晰的成本边界。ChatGPT和Codex的订阅价格及额度总量没有变化,只是使用Luna和Terra时扣除的额度减少。旗舰模型Sol价格未动,API新推出的Fast模式则以两倍标准价格换取最高2.5倍的速度。 Anthropic用Pro、Max等档位区分额度,Max内部又分为5倍和20倍用量,达到上限后还能继续购买Credits。DeepSeek把V4拆成Flash和Pro两档,对缓存命中、普通输入和输出分别收费,高峰时段价格还会翻倍。 厂商希望用免费Token换来长期调用,但企业也在迅速学会“薅完就走”。Pylon一边从多家供应商手里领取免费额度,一边明确表示看不到任何忠诚度。Cursor、Zoom和Hex则把多个模型同时接入工作流,随时根据价格和效果重新分配任务。 微软对数万名工程师的研究发现,编程Agent的第一次使用往往由同事带动,但后续是否持续使用,主要取决于工程师是否真的有足够的编程需求,持续使用者合并的PR数量提高约24%。真正能留下用户的,仍然是产品能否进入日常工作。 Token越送越多,用户却未必留下。用户真留下来,算力账单又会跟着上涨。最棘手的是,调用量和成本可以一起增长,收入却未必跟得上。

相关标签

免责声明:本文内容来自公开报道与编辑整理,仅供参考。转载请注明出处;版权争议请联系本站核实处理。页面地址:/?m/focus/20260811-859.shtml

评论区

热门讨论 · 占位展示
说说你的看法…
发表评论
  • 用户
    读者2号
    带孩子一起看了不少条目,很多“为什么”都能找到靠谱且好懂的说法。语言通俗,但没有把科学讲成尴尬段子,分寸拿得住。学习记录能看见看过哪些主题,有种在铺知识地图的感觉。耳朵也能学,时间碎的人几乎能无痛坚持。作为主力科普入口长期留下很合适。把核心求知需求解决得很扎实。
    20260811 · 来自移动端
  • 用户
    林祖权
    地理、人体、材料这些基础坑终于补上一些了,文风也耐心。内容更新偏稳,宁缺毋滥,注水感不强。分类能按学科,也能按生活场景找,通勤或睡前翻两篇都不累。更愿意为真正优质内容付费,而不是为只有钩子的东西买单。作为主力科普入口长期留下很合适。真实路径走下来,优点大多能稳定复现。
    2026-08-11 12:25:03
  • 用户
    热心网友
    《蘑菇视频》,内容值得关注,期待后续更新。
    20260811

期待你的精彩发言。