文章摘要
2026年7月,OpenAI等巨头大幅降价对标DeepSeek,将全球大模型价格战推向白热化。OpenAI下调GPT - 5.6系列API价格,谷歌推出低价模型,Anthropic则以“加量不加价”变相降价。这源于中国厂商低价冲击,成本结构差异使价格战或长期持续。虽巨头降价,但旗舰模型价格未变,AI推理正迈向普惠时代。

2026年7月,OpenAI等巨头大幅降价对标DeepSeek,将全球大模型价格战推向白热化。OpenAI将GPT-5.6 Luna价格下调80%,谷歌推出更低价的Gemini 3.6 Flash,Anthropic以更强模型维持原价。这场由DeepSeek点燃的降价潮,正在彻底改写全球AI推理的经济账本——当OpenAI等巨头大幅降价对标DeepSeek时,行业竞争的核心已从“谁更聪明”转向“谁更便宜地完成任务”。

OpenAI等巨头大幅降价对标DeepSeek]

OpenAI的降价:防守还是进攻

降价幅度与范围

2026年7月30日,OpenAI突然宣布大幅下调GPT-5.6系列API价格。入门级轻量模型GPT-5.6 Luna迎来史上最大幅度调价——输入价格从每百万Token 1美元降至0.2美元,输出价格从6美元降至1.2美元,降幅高达80%。中端均衡版GPT-5.6 Terra同步下调20%,输入降至2美元/百万Token,输出降至12美元/百万Token。旗舰版GPT-5.6 Sol定价维持不变,但新增了Fast模式,以2倍价格换取最高2.5倍推理速度。

这一调价的时间节点格外引人注目——GPT-5.6系列于7月10日才正式发布,从发布到大幅降价,前后仅相隔三周。在传统软件行业,一个旗舰产品线发布不到一个月就降价80%,几乎是不可想象的。

降价的直接动因

OpenAI等巨头大幅降价对标DeepSeek,直接动因来自中国大模型厂商的持续低价冲击。2026年5月,DeepSeek宣布将V4-Pro模型API永久降价75%,缓存命中场景下输入价格低至每百万Token仅0.025元人民币(约0.0036美元),输出降至6元人民币(约0.87美元)。这一价格击穿了当时全球高端推理模型的价格底线。

与此同时,多家国内厂商持续推出平价API服务,持续分流海外中小开发者客户。DeepSeek在2025年已经给西方AI开发商带来巨大冲击,而月之暗面的Kimi K3在2026年再次产生类似影响。当市场出现性能接近但价格大幅降低的新模型时,整个行业都受到了强烈震动。

分层定价策略的深意

OpenAI此次降价采用了极其精准的分层策略:入门款Luna打两折,中端款Terra只打八折,旗舰款Sol一分钱不降。这种打法类似于航空公司的舱位策略——经济舱打折拉客流,头等舱维持高价保利润。

OpenAI心里很清楚:高频、简单的任务可以便宜卖,但最顶尖的前沿能力绝不能贱卖。Luna降价后,其价格已进入DeepSeek V4的竞争范围。降价后的GPT-5.6 Luna,在同等标准任务的综合性价比上,据第三方机构评测已全面超过DeepSeek V4 Pro。但OpenAI并未降低旗舰模型的价格——事实上,Sol的Fast模式价格反而更高。

谷歌与Anthropic的应对

谷歌:更低价的Flash系列

在OpenAI降价之前约一周,谷歌已经率先行动,推出了价格更低的Gemini 3.6 Flash和3.5 Flash-Lite模型。Gemini 3.6 Flash被定位为谷歌的通用主力模型,输入定价为每百万Token 1.5美元,输出定价为7.5美元。与上一代Gemini 3.5 Flash相比,输出价格从9美元降至7.5美元。两款模型均支持100万Token的输入上下文窗口。

谷歌的降价逻辑与OpenAI类似:通过更具成本效益的轻量级模型,守住开发者和中小企业市场的基本盘。但Gemini 3.6 Flash的定价仍远高于DeepSeek V4-Flash的输出价(0.28美元/百万Token)——两者相差约27倍。这也意味着,OpenAI等巨头大幅降价对标DeepSeek,但谷歌的跟进力度相对有限。

Anthropic:加量不加价

Anthropic采取了与OpenAI和谷歌截然不同的策略——没有直接降价,但将旗下价格最低的Opus 4.8模型替换为能力更强的Claude 5.0,维持相同价格。这是一种“加量不加价”的变相降价。

与此同时,Anthropic在2026年7月发布了Claude Sonnet 5,推广期内API定价为每百万输入Token 2美元、输出Token 10美元。公司称其为“迄今最具智能体能力的Sonnet模型”。而旗舰模型Opus 5定价为每百万输入Token 5美元、输出Token 25美元。

Anthropic的应对策略反映了其独特的市场定位——它不试图在价格上与中国厂商正面竞争,而是通过持续提升产品能力来维持溢价。但即便如此,DeepSeek V4-Flash的运行成本比Anthropic Claude Fable 5便宜约105倍的事实,仍然让Anthropic承受着巨大的定价压力。

横向对比:谁在降价,谁在坚守

下表展示了截至2026年8月初,主要大模型厂商的定价策略与核心产品价格对比:

厂商 模型 输入价($/百万Token) 输出价($/百万Token) 降价幅度 策略定位
OpenAI GPT-5.6 Luna 0.20 1.20 ↓80% 轻量入门,抢占批量推理市场
OpenAI GPT-5.6 Terra 2.00 12.00 ↓20% 中端均衡,日常工作任务
OpenAI GPT-5.6 Sol 5.00 30.00 不变 旗舰高端,维持利润堡垒
谷歌 Gemini 3.6 Flash 1.50 7.50 输出↓17% 通用主力,多模态任务
谷歌 Gemini 3.5 Flash-Lite 新推出 轻量高性价比
Anthropic Claude Opus 5 5.00 25.00 不变 旗舰模型
Anthropic Claude Sonnet 5 2.00 10.00 推广价 高性价比智能体
Anthropic Claude Fable 5 10.00 50.00 不变 顶级性能
DeepSeek V4-Flash 0.14 0.28 基准线,缓存命中可低至0.0028
DeepSeek V4-Pro 0.435 0.87 永久↓75% 专业版
月之暗面 Kimi K3 3.00 15.00 中国新一代模型

数据来源:各厂商官方API定价及公开报道

从表格可以清晰看到,OpenAI等巨头大幅降价对标DeepSeek,主要集中在中低端产品线。Luna降价80%后,其输出价(1.20美元)仍比DeepSeek V4-Flash(0.28美元)高出约4倍。即便降价幅度如此之大,DeepSeek V4-Flash在自有API上的单任务成本仍比降价后的GPT-5.6 Luna低约60%。关键原因在于DeepSeek提供了约98%的缓存命中折扣——命中缓存的Token仅按标价2%计费,远超业内普遍的90%折扣水平。

价格战的深层逻辑

成本结构的天壤之别

OpenAI等巨头大幅降价对标DeepSeek,背后是两种截然不同的成本结构。

DeepSeek V4-Flash采用MoE(混合专家)架构,总参数284B,激活参数仅13B。这意味着“养了2840个专家,但每次只让最相关的13个会诊”——既保证了模型能力的上限,又将每次推理的实际成本压到了极致。DeepSeek的低价策略并非亏损补贴,而是通过稀疏注意力和MoE架构把算力消耗压缩到上代产品的27%。

相比之下,OpenAI的GPT-5.6系列采用稠密架构,每次推理需要激活全部参数。这种架构差异直接反映在成本上——DeepSeek V4-Flash每次基准测试的平均成本约3美分,而OpenAI GPT-5.6 Sol需要1.86美元,Anthropic Claude Fable 5需要3.15美元。运行完整基准测试套件,DeepSeek V4-Flash Max的成本为72.02美元,而Claude Opus 4.8 Max高达3,752.55美元。

性能差距在收窄,价格差距在扩大

Artificial Analysis的智能指数显示,DeepSeek V4-Flash获得50分,仅比GPT-5.6 Luna的51分低1分。在Agent能力上,V4-Flash正式版得分达25.2分,接近Opus 4.8的25.7分。在终端基准Terminal-Bench 2.1上,V4-Flash得分82.7,逼近Claude Opus 4.8的85分。

换言之,DeepSeek V4-Flash与顶级闭源模型的性能差距只有几分,但价格差距却是几十倍甚至上百倍。Claude Opus 4.8多拿6分,成本却高出52倍。这种“性能溢价”正在变得越来越难以合理化。

开发者用脚投票

价格战的效果已经在数据上得到了验证。模型API分发平台OpenRouter最新数据显示,2026年7月27日至8月2日当周,DeepSeek V4-Flash以7.22万亿Token的周调用量位居第一。海外开发者开源项目OpenCode披露,其平台上DeepSeek V4-Flash单日处理达8万亿Token。

在OpenCode CEO Jay发文庆祝调用量飙升的评论区,OpenAI核心产品与平台负责人Tibo打起了GPT-5.6 Luna的广告。但开发者并未买账,评论区有开发者直言:“我们希望得到DeepSeek的价格。”

这一幕恰恰折射出OpenAI等巨头大幅降价对标DeepSeek的尴尬处境——即便降价80%,仍然无法在成本上赢得开发者的认同。OpenAI的降价非但没能夺回叙事权,反而坐实了“闭源模型溢价过高”的标签。

降价潮的市场影响

微软的“倒戈”:一个标志性信号

OpenAI等巨头大幅降价对标DeepSeek的同时,一个更具象征意义的事件正在发生——微软,OpenAI的最大投资方和战略合作伙伴,正在评估用DeepSeek替代OpenAI。

据Axios披露,微软正在测试经过微调的DeepSeek V4模型,作为Copilot Cowork的低成本引擎,以替代Anthropic和OpenAI。微软特意强调,该模型将“完全托管于Azure”并加入微调护栏。

这意味着中国开源模型已经踩着“本地托管”的跳板,实质性挤入了全球顶级企业软件的采购清单。OpenAI再不降价,连核心客户都可能流失。当OpenAI等巨头大幅降价对标DeepSeek时,这场价格战的性质已经从“争夺开发者”升级为“保卫基本盘”。

企业市场的份额重构

价格战的另一面是企业级AI市场份额的剧烈变动。根据美国机构Ramp发布的报告,2026年4月,Anthropic以34.4%的全美企业级AI支出份额首次超越OpenAI的32.3%。到了6月,随着企业级AI采用率整体突破50%,Anthropic的份额飙升至41%,将OpenAI远远甩在身后。

从12%到41%,Anthropic只用了三年。而OpenAI呢?2025年全年营收130.7亿美元,净亏损385亿美元。仅2026年一个季度,就亏损37亿美元。预计要到2030年才有望实现盈亏平衡。

在这样的财务压力下,OpenAI等巨头大幅降价对标DeepSeek,某种程度上是一种“以价换量”的无奈之举——降价会进一步侵蚀本已糟糕的利润率,但不降价,市场份额会被竞争对手蚕食殆尽。

从“拼性能”到“拼性价比”

这场价格战标志着AI大模型竞争的根本性转变。过去两年,行业默认的竞争逻辑是“谁更强谁就能卖更贵”。但OpenAI等巨头大幅降价对标DeepSeek,证明了另一种逻辑正在成为主流:谁能用更低的成本完成同样的任务,谁就能赢得市场。

DeepSeek正在把AI大模型竞争从“拼性能”变成“拼性价比”。模型降价正在推动AI技术普惠,此前业内前沿模型往往闭源且API调用成本高企,使得AI的使用门槛和落地成本较高。而如今,平价化、开源化的模型供给正在有效削减企业研发与运营成本。

单一高价旗舰模型全覆盖的传统模式逐步退场,多模型分工协作、按需调度已成为主流。标准化、低门槛的基础任务交由高性价比开源模型承接,仅在复杂逻辑推理等核心高价值环节调用旗舰模型。

降价潮的局限与未来

旗舰模型的价格堡垒仍在

值得注意的是,OpenAI等巨头大幅降价对标DeepSeek,并未触及旗舰模型的价格体系。GPT-5.6 Sol仍保持每百万输入Token 5美元、输出Token 30美元的价格。Anthropic的Claude Fable 5定价为输入10美元、输出50美元。

旗舰模型仍然是这些厂商最后的利润堡垒。对于那些需要顶尖智能解决疑难任务的场景——复杂代码生成、高难度数学推理、多模态深度思考——旗舰模型仍有不可替代的价值。DeepSeek V4-Flash在智能指数上得50分,而Claude Opus 4.8 Max得56分。虽然50分与56分的差距在性价比面前显得微不足道,但对于某些特定场景,这6分的差距可能决定成败。

缓存依赖的成本陷阱

DeepSeek的价格优势在相当程度上依赖于缓存命中。V4-Flash在长上下文命中缓存时折扣高达98%,输入单价从0.14美元降至0.0028美元/百万Token。但如果使用场景是短请求、高频、上下文各不相同,缓存命中率上不去,实际账单与理论最优值会差出好几倍。

这也是OpenAI等巨头大幅降价对标DeepSeek时可以利用的差异化空间——对于无法充分利用缓存的场景,降价后的Luna可能比DeepSeek更具吸引力。真正的竞争不在于谁的标价更低,而在于谁的“实际完成任务的成本”更低。

价格战远未结束

OpenAI等巨头大幅降价对标DeepSeek,只是这场价格战的开始,而非终点。行业分析认为,这场价格战的本质是两种技术路线的对决——闭源稠密架构 vs 开源MoE架构。只要成本结构的差异存在,价格战就会持续。

对于普通用户和开发者而言,这意味着更便宜的API调用、更便宜的应用和工具。AI推理正在从“奢侈品”变成“日用品”,而这正是OpenAI等巨头大幅降价对标DeepSeek所推动的行业变革。

常见问题(FAQ)

问:OpenAI等巨头大幅降价对标DeepSeek,具体降了多少?

OpenAI将GPT-5.6 Luna价格下调80%,输入从每百万Token 1美元降至0.2美元,输出从6美元降至1.2美元。中端Terra下调20%,输入降至2美元,输出降至12美元。谷歌推出更低价的Gemini 3.6 Flash。Anthropic以更强模型维持原价,变相降价。

问:OpenAI为什么要降价?

直接原因是DeepSeek等中国大模型厂商的持续低价冲击。DeepSeek在2026年5月将V4-Pro永久降价75%,缓存命中价低至每百万Token 0.025元人民币。面对性能接近、价格低几十倍的竞品,OpenAI被迫跟进降价。

问:降价后的OpenAI比DeepSeek便宜吗?

没有。即便降价80%,GPT-5.6 Luna的输出价(1.20美元/百万Token)仍比DeepSeek V4-Flash(0.28美元/百万Token)高出约4倍。DeepSeek还提供约98%的缓存命中折扣。

问:谷歌和Anthropic也降价了吗?

谷歌在OpenAI之前推出了Gemini 3.6 Flash,输出价从9美元降至7.5美元/百万Token。Anthropic没有直接降价,但将Opus 4.8替换为能力更强的Claude 5.0并维持原价。

问:这场价格战对开发者意味着什么?

对开发者而言,这意味着AI推理成本的大幅下降。DeepSeek V4-Flash每次基准测试成本仅3美分,而OpenAI GPT-5.6 Sol需1.86美元。更低的价格意味着更低的AI应用开发门槛和更多的创新空间。

问:旗舰模型会降价吗?

目前不会。OpenAI的GPT-5.6 Sol和Anthropic的Claude Fable 5均维持原价。旗舰模型仍是这些厂商维持利润的核心产品,短期内降价可能性较低。

问:价格战会持续多久?

只要成本结构的差异存在,价格战就会持续。DeepSeek的MoE架构在推理成本上具有结构性优势,而OpenAI等采用稠密架构的厂商在成本上难以匹敌。预计这场价格战将长期持续。

以上内容不代表本平台立场,仅供读者参考