被冠以“价格屠夫”称号的大模型圈顶流,打算涨价了。

8月6日,DeepSeek在用户后台发布了一则公告,预告近期将对API服务进行整体提价,并特意提示用户“预计涨幅较大”,建议大家提前规划好使用需求和充值额度。

图源:DeepSeek

消息传出,舆论哗然。过去两年里,每当Token价格战打响,DeepSeek总是那个带头掀桌子的人。如今,正是它亲手把Token价格打下来的,现在却主动宣布要“大幅涨价”,这姿态颇有些发起者准备鸣金收兵的味道。

无独有偶,路透社在8月7日报道称,阿里计划对旗下千问下一代开源大模型的头部商用客户收取营收分成。此前,只有在使用阿里云平台调用模型的开发者才需付费,这是阿里云主推的MaaS(模型即服务)模式。但若客户将开源模型部署在自己的数据中心,则可以全程免费。从Kimi K3等开放权重模型开始尝试分成模式来看,开源大模型“免费午餐”的日子恐怕屈指可数。

那么,这场持续两年多的Token价格战,真的要画上句号了吗?

DeepSeek曾经便宜到什么程度?

在讨论涨价之前,不妨先回顾一下DeepSeek当下的价格有多低。

根据DeepSeek API官方页面显示,目前DeepSeek-V4-Flash的缓存命中输入价格为每百万Token 0.02元,缓存未命中输入为1元,输出为2元;性能更强的DeepSeek-V4-Pro对应价格分别为0.025元、3元和6元。

图源:DeepSeek

DeepSeek此前曾预告将引入峰谷定价机制,在北京时间每天9点至12点、14点至18点的高峰期,所有计费项目价格调整为平时的两倍。不过截至8月6日,这一机制同样尚未落地实施。

即便如此,仅看标准定价,DeepSeek-V4-Flash依然便宜得令人咋舌。海外研究机构Artificial Analysis的测试数据显示,DeepSeek-V4-Flash完成一轮综合基准测试的平均成本仅为0.03美元左右。

作为对比,Kimi K3完成相同测试的平均成本约为0.86美元,OpenAI GPT-5.6 Sol约为1.86美元,Anthropic Claude Fable 5更是高达3.15美元。这意味着,在该测试标准下,DeepSeek-V4-Flash的任务成本甚至不到部分海外旗舰模型的百分之一。

图源:Artificial Analysis

当然,有人指出模型能力存在差异,这确实是不争的事实。从Artificial Analysis的榜单来看,DeepSeek V4 Flash 0731 Max的得分与Fable 5相差11分。但当价格差距扩大到百倍量级时,情况就变了,毕竟绝大多数任务并不需要如此强悍的模型性能。

此外,榜单显示DeepSeek的价格比成绩相近的Gemini 3.6 Flash High低了90%。对于大多数用户而言,“物美价廉”一词用来形容再合适不过。正因如此,DeepSeek此次特意强调“预计涨幅较大”,引发了大量开发者的焦虑。

尤其在Agent时代,AI需要执行的任务早已超越简单的一问一答。以编程任务为例,Agent AI为了完成任务,可能需要读取整个代码库,生成计划并调用工具,最后运行测试。一旦发现错误,还需重新修改并再次调用模型验证。

图源:雷科技

表面上看,用户只输入了一句指令,但当AI完成任务并返回结果时,背后可能已经进行了几十轮甚至上百轮的模型调用。可以说,在Agent模式下,AI的Token消耗呈指数级增长。当每日消耗的Token达到几十亿甚至万亿级别时,即便单价仅上涨几毛钱,账单金额也可能激增数十万元,甚至更多。

坦白说,DeepSeek起初或许并未充分意识到这一问题,直到用户使用量飙升后才幡然醒悟。简言之,DeepSeek可能预见到自家模型会广受欢迎,却低估了Agent场景下的Token消耗量,导致服务器算力被迅速耗尽。

况且,据Artificial Analysis测试显示,DeepSeek V4 Flash 0731 Max还是个不折不扣的“话痨”。其他模型仅需几千万至1亿Token即可完成的测试,DeepSeek硬是耗用了2.1亿Token。不过,若DeepSeek能将Token输出量降至与其他模型相当的水平,成本还可再降50%,这对其他AI公司来说无疑是巨大的威胁。

调用量全球第一,DeepSeek算力濒临极限

多数人最大的疑问或许是:DeepSeek为何此时突然选择涨价?

答案在于最新更新的DeepSeek V4 Flash 0731 Max实力过于强劲。尽管从版本号看,其定位低于V4 Pro,但在Agent能力上提升显著,而这正是重度AI用户最渴求的功能。

反映在实际数据上,便是调用量的爆发式增长。根据OpenRouter最新统计,DeepSeek-V4-Flash近一周处理量已达约6.6万亿Token。虽较上一周下降10%,但在当前模型调用榜中仍稳居第一。

图源:

若只是单纯排名第一倒也罢了。更惊人的是,在OpenRouter平台统计的所有模型中,DeepSeek-V4-Flash的使用量同样位居榜首,占据约58%的Token份额。数据显示,从6月12日至8月6日,该模型累计处理量达约97万亿Token,完成会话超过1000万次。

即便这只是第三方平台的数据,也足以让人震惊,因为DeepSeek是在Gemini、ChatGPT、Claude等顶级AI中脱颖而出,拿下了这一份额。

这也折射出DeepSeek面临的巨大算力压力。每周数万亿Token的处理量,对于一家量化企业而言,负担沉重。此前有报道称,DeepSeek拥有一座十万卡规模的数据中心,听起来规模宏大,但与Google、OpenAI等AI巨头相比,数量级上仍有差距,更遑论与亚马逊、阿里云等云服务巨头抗衡。

事实上,自上周起,关于DeepSeek算力不足、限制使用的传闻不绝于耳。前几天小雷打开DeepSeek网页版,试图体验专业模式,页面直接提示“服务繁忙”。说实话,除了去年初DeepSeek首次爆火时,小雷已很久未在此处看到此类提示。

其实,早在DeepSeek发布V4版本初期,便因调用量过大而宣布未来将采用峰谷定价策略。然而,该计划至今未能实施,原因是DeepSeek发现自己的服务器几乎没有降至“谷底”的时候。

网上有DeepSeek用户晒出官方群发的故障公告,前后两个性能下降公告分别发布于中国工作日上午和美国工作日上午。深夜时分,国内用户确实停止使用,但美国用户正值清晨,开始忙碌起来。因此,哪里还有“谷底”?全是“峰顶”。

对DeepSeek而言,目前的定价别说盈利,能实现收支平衡便已不易。甚至有业内人士猜测,DeepSeek一直在补贴Token价格。否则,以现有算力规模,Token价格不可能维持如此低位(不少网友因此尊称梁文锋为“梁圣”,感谢其开源及超低价Token)。

图源:微博

当然,若DeepSeek不承认此事,旁人难以证伪。但可以肯定的是,低价确实能吸引开发者,但价格过低也会引发另一问题:各类琐碎需求涌向DeepSeek。

例如,某开发者用AI写程序遇到一个小BUG。他自己花十来分钟便能排查,但因DeepSeek价格低廉,跑一轮debug仅需几毛钱,他便不愿亲自动手,而是丢给DeepSeek解决。

反之,若使用Claude等高價模型,随意跑个任务便需几块乃至十几块钱,开发者可能不舍得让AI运行,转而选择手动debug。莫小看这两种心态的差异,当多数用户皆如此时,DeepSeek的大量算力便被耗费在简单任务上。

这些请求还会挤占复杂任务的算力资源,导致前文提及的“拥堵”现象。当然,用户既已付费,如何使用由他们决定,但对DeepSeek而言,必须更多考量那些将Token用于商业项目的用户,尽可能保障其体验。

因此,在坚持一段时间低价后,DeepSeek涨价实属意料之中。若细究之,DeepSeek当初宣布降价时使用“限时”字样,想必早已做好涨价准备。

站在消费者角度,小雷自然希望DeepSeek优惠长存;但从行业视角看,靠补贴抢市场绝非长久之计,尤其是AI这样重投入、快迭代的领域,企业必须考虑收支平衡。

更何况,DeepSeek的价格优势实在太过明显。从目前情况看,即便涨价数倍,依然具备不错性价比,对多数开发者而言,仍是性价比最高的选择。

Token低价时代落幕,商业化成新重心

虽然DeepSeek宣布涨价后,有网友视此为Token价格战结束的信号,但小雷持不同看法,反而认为价格战才刚刚拉开序幕。

几乎同一时间,

过去两年的价格战逻辑简单粗暴:各家厂商比拼每百万Token多少钱。今日你宣布降至5块,明日对手便掏出2.5块的价格迎战。甚至有些AI公司直接以千万Token为单位派发免费额度,再辅以限时折扣和缓存优惠,致使Token价格一度低到让开发者几乎忽略不计。

但随着模型能力和应用场景不断演变,单纯比较Token价格已意义不大。首先,不同模型完成同一任务所需的Token数量各异。以Artificial Analysis的测试为例,DeepSeek消耗2.1亿Token,Gemini 3.6 Flash High则消耗5900万Token,差距接近3.5倍。

图源:Artificial Analysis

这也是为何Gemini 3.6 Flash High的Token输出价格几乎是DeepSeek的20倍,最终两者测试任务成本仅相差10倍。随着任务复杂度提升,两者差价有望进一步缩小,进而影响模型竞争力。

其次,模型速度与稳定性也开始影响企业成本。若API响应迟缓、频繁超时或高峰期不可用,将带来严重体验问题。特别是对于需要实时演算、对稳定性要求极高的业务(如金融领域),稳定性至关重要。

随着AI真正嵌入各行业底层运行链条,一个明显变化浮现:除价格外,企业对算力提出了更多要求——稳定性、性能和速度。对DeepSeek而言,虽不靠Token赚钱,但若想在模型领域保持一席之地,就必须兼顾B端需求。

此时,通过适当涨价“劝退”部分用户并提升高价值用户体验,成为最合适的方案。虽听起来略显冷酷,但从企业角度看无可厚非。且V4 Flash 0731已有如此表现,后续V4 Pro xxxx版或许更强,若价格差距拉得过大,也不利于DeepSeek平衡两个版本的性价比。

纵观全球AI模型市场,不难发现近几个月大家都在推动模型“细分化”,构建阶梯式的性能与价格体系,以满足多样化用户需求。因此,与其说价格战结束,不如说真正的价格战此刻才正式开始。AI企业即将进入“肉搏”阶段,期望凭借更具性价比的模型、更稳定快速的服务,抢占更多B端市场份额。

可以说,Token的商业化大战,至此才正式打响。

机器人产业最重要的风向标,世界机器人大会(WRC)2026重磅来袭,随后还有世界人形机器人运动会紧随其后。

宇树、智元、启元、魔法原子、银河通用、云深处、灵心巧手等300余家TOP展商联袂呈现,共同定义全球机器人产业未来!

所有关于机器人的核心议题,WRC都将给出答案。

雷科技WRC 2026报道团,空降北京重磅呈现。