OpenAI等巨头大幅降价对标DeepSeek:AI推理进入普惠内卷时代

2026年7月,OpenAI等巨头大幅降价对标DeepSeek,将全球大模型价格战推向白热化。OpenAI将GPT-5.6 Luna价格下调80%,谷歌推出更低价的Gemini 3.6 Flash,Anthropic以更强模型维持原价。这场由DeepSeek点燃的降价潮,正在彻底改写全球AI推理的经济账本——当OpenAI等巨头大幅降价对标DeepSeek时,行业竞争的核心已从“谁更聪明”转向“谁更便宜地完成任务”。
]
OpenAI的降价:防守还是进攻
降价幅度与范围
2026年7月30日,OpenAI突然宣布大幅下调GPT-5.6系列API价格。入门级轻量模型GPT-5.6 Luna迎来史上最大幅度调价——输入价格从每百万Token 1美元降至0.2美元,输出价格从6美元降至1.2美元,降幅高达80%。中端均衡版GPT-5.6 Terra同步下调20%,输入降至2美元/百万Token,输出降至12美元/百万Token。旗舰版GPT-5.6 Sol定价维持不变,但新增了Fast模式,以2倍价格换取最高2.5倍推理速度。
这一调价的时间节点格外引人注目——GPT-5.6系列于7月10日才正式发布,从发布到大幅降价,前后仅相隔三周。在传统软件行业,一个旗舰产品线发布不到一个月就降价80%,几乎是不可想象的。
降价的直接动因
OpenAI等巨头大幅降价对标DeepSeek,直接动因来自中国大模型厂商的持续低价冲击。2026年5月,DeepSeek宣布将V4-Pro模型API永久降价75%,缓存命中场景下输入价格低至每百万Token仅0.025元人民币(约0.0036美元),输出降至6元人民币(约0.87美元)。这一价格击穿了当时全球高端推理模型的价格底线。
与此同时,多家国内厂商持续推出平价API服务,持续分流海外中小开发者客户。DeepSeek在2025年已经给西方AI开发商带来巨大冲击,而月之暗面的Kimi K3在2026年再次产生类似影响。当市场出现性能接近但价格大幅降低的新模型时,整个行业都受到了强烈震动。
分层定价策略的深意
OpenAI此次降价采用了极其精准的分层策略:入门款Luna打两折,中端款Terra只打八折,旗舰款Sol一分钱不降。这种打法类似于航空公司的舱位策略——经济舱打折拉客流,头等舱维持高价保利润。
OpenAI心里很清楚:高频、简单的任务可以便宜卖,但最顶尖的前沿能力绝不能贱卖。Luna降价后,其价格已进入DeepSeek V4的竞争范围。降价后的GPT-5.6 Luna,在同等标准任务的综合性价比上,据第三方机构评测已全面超过DeepSeek V4 Pro。但OpenAI并未降低旗舰模型的价格——事实上,Sol的Fast模式价格反而更高。
谷歌与Anthropic的应对
谷歌:更低价的Flash系列
在OpenAI降价之前约一周,谷歌已经率先行动,推出了价格更低的Gemini 3.6 Flash和3.5 Flash-Lite模型。Gemini 3.6 Flash被定位为谷歌的通用主力模型,输入定价为每百万Token 1.5美元,输出定价为7.5美元。与上一代Gemini 3.5 Flash相比,输出价格从9美元降至7.5美元。两款模型均支持100万Token的输入上下文窗口。
谷歌的降价逻辑与OpenAI类似:通过更具成本效益的轻量级模型,守住开发者和中小企业市场的基本盘。但Gemini 3.6 Flash的定价仍远高于DeepSeek V4-Flash的输出价(0.28美元/百万Token)——两者相差约27倍。这也意味着,OpenAI等巨头大幅降价对标DeepSeek,但谷歌的跟进力度相对有限。
Anthropic:加量不加价
Anthropic采取了与OpenAI和谷歌截然不同的策略——没有直接降价,但将旗下价格最低的Opus 4.8模型替换为能力更强的Claude 5.0,维持相同价格。这是一种“加量不加价”的变相降价。
与此同时,Anthropic在2026年7月发布了Claude Sonnet 5,推广期内API定价为每百万输入Token 2美元、输出Token 10美元。公司称其为“迄今最具智能体能力的Sonnet模型”。而旗舰模型Opus 5定价为每百万输入Token 5美元、输出Token 25美元。
Anthropic的应对策略反映了其独特的市场定位——它不试图在价格上与中国厂商正面竞争,而是通过持续提升产品能力来维持溢价。但即便如此,DeepSeek V4-Flash的运行成本比Anthropic Claude Fable 5便宜约105倍的事实,仍然让Anthropic承受着巨大的定价压力。
横向对比:谁在降价,谁在坚守
下表展示了截至2026年8月初,主要大模型厂商的定价策略与核心产品价格对比:
| 厂商 | 模型 | 输入价($/百万Token) | 输出价($/百万Token) | 降价幅度 | 策略定位 |
|---|---|---|---|---|---|
| OpenAI | GPT-5.6 Luna | 0.20 | 1.20 | ↓80% | 轻量入门,抢占批量推理市场 |
| OpenAI | GPT-5.6 Terra | 2.00 | 12.00 | ↓20% | 中端均衡,日常工作任务 |
| OpenAI | GPT-5.6 Sol | 5.00 | 30.00 | 不变 | 旗舰高端,维持利润堡垒 |
| 谷歌 | Gemini 3.6 Flash | 1.50 | 7.50 | 输出↓17% | 通用主力,多模态任务 |
| 谷歌 | Gemini 3.5 Flash-Lite | — | — | 新推出 | 轻量高性价比 |
| Anthropic | Claude Opus 5 | 5.00 | 25.00 | 不变 | 旗舰模型 |
| Anthropic | Claude Sonnet 5 | 2.00 | 10.00 | 推广价 | 高性价比智能体 |
| Anthropic | Claude Fable 5 | 10.00 | 50.00 | 不变 | 顶级性能 |
| DeepSeek | V4-Flash | 0.14 | 0.28 | — | 基准线,缓存命中可低至0.0028 |
| DeepSeek | V4-Pro | 0.435 | 0.87 | 永久↓75% | 专业版 |
| 月之暗面 | Kimi K3 | 3.00 | 15.00 | — | 中国新一代模型 |
数据来源:各厂商官方API定价及公开报道
从表格可以清晰看到,OpenAI等巨头大幅降价对标DeepSeek,主要集中在中低端产品线。Luna降价80%后,其输出价(1.20美元)仍比DeepSeek V4-Flash(0.28美元)高出约4倍。即便降价幅度如此之大,DeepSeek V4-Flash在自有API上的单任务成本仍比降价后的GPT-5.6 Luna低约60%。关键原因在于DeepSeek提供了约98%的缓存命中折扣——命中缓存的Token仅按标价2%计费,远超业内普遍的90%折扣水平。
价格战的深层逻辑
成本结构的天壤之别
OpenAI等巨头大幅降价对标DeepSeek,背后是两种截然不同的成本结构。
DeepSeek V4-Flash采用MoE(混合专家)架构,总参数284B,激活参数仅13B。这意味着“养了2840个专家,但每次只让最相关的13个会诊”——既保证了模型能力的上限,又将每次推理的实际成本压到了极致。DeepSeek的低价策略并非亏损补贴,而是通过稀疏注意力和MoE架构把算力消耗压缩到上代产品的27%。
相比之下,OpenAI的GPT-5.6系列采用稠密架构,每次推理需要激活全部参数。这种架构差异直接反映在成本上——DeepSeek V4-Flash每次基准测试的平均成本约3美分,而OpenAI GPT-5.6 Sol需要1.86美元,Anthropic Claude Fable 5需要3.15美元。运行完整基准测试套件,DeepSeek V4-Flash Max的成本为72.02美元,而Claude Opus 4.8 Max高达3,752.55美元。
性能差距在收窄,价格差距在扩大
Artificial Analysis的智能指数显示,DeepSeek V4-Flash获得50分,仅比GPT-5.6 Luna的51分低1分。在Agent能力上,V4-Flash正式版得分达25.2分,接近Opus 4.8的25.7分。在终端基准Terminal-Bench 2.1上,V4-Flash得分82.7,逼近Claude Opus 4.8的85分。
换言之,DeepSeek V4-Flash与顶级闭源模型的性能差距只有几分,但价格差距却是几十倍甚至上百倍。Claude Opus 4.8多拿6分,成本却高出52倍。这种“性能溢价”正在变得越来越难以合理化。
开发者用脚投票
价格战的效果已经在数据上得到了验证。模型API分发平台OpenRouter最新数据显示,2026年7月27日至8月2日当周,DeepSeek V4-Flash以7.22万亿Token的周调用量位居第一。海外开发者开源项目OpenCode披露,其平台上DeepSeek V4-Flash单日处理达8万亿Token。
在OpenCode CEO Jay发文庆祝调用量飙升的评论区,OpenAI核心产品与平台负责人Tibo打起了GPT-5.6 Luna的广告。但开发者并未买账,评论区有开发者直言:“我们希望得到DeepSeek的价格。”
这一幕恰恰折射出OpenAI等巨头大幅降价对标DeepSeek的尴尬处境——即便降价80%,仍然无法在成本上赢得开发者的认同。OpenAI的降价非但没能夺回叙事权,反而坐实了“闭源模型溢价过高”的标签。
降价潮的市场影响
微软的“倒戈”:一个标志性信号
OpenAI等巨头大幅降价对标DeepSeek的同时,一个更具象征意义的事件正在发生——微软,OpenAI的最大投资方和战略合作伙伴,正在评估用DeepSeek替代OpenAI。
据Axios披露,微软正在测试经过微调的DeepSeek V4模型,作为Copilot Cowork的低成本引擎,以替代Anthropic和OpenAI。微软特意强调,该模型将“完全托管于Azure”并加入微调护栏。
这意味着中国开源模型已经踩着“本地托管”的跳板,实质性挤入了全球顶级企业软件的采购清单。OpenAI再不降价,连核心客户都可能流失。当OpenAI等巨头大幅降价对标DeepSeek时,这场价格战的性质已经从“争夺开发者”升级为“保卫基本盘”。
企业市场的份额重构
价格战的另一面是企业级AI市场份额的剧烈变动。根据美国机构Ramp发布的报告,2026年4月,Anthropic以34.4%的全美企业级AI支出份额首次超越OpenAI的32.3%。到了6月,随着企业级AI采用率整体突破50%,Anthropic的份额飙升至41%,将OpenAI远远甩在身后。
从12%到41%,Anthropic只用了三年。而OpenAI呢?2025年全年营收130.7亿美元,净亏损385亿美元。仅2026年一个季度,就亏损37亿美元。预计要到2030年才有望实现盈亏平衡。
在这样的财务压力下,OpenAI等巨头大幅降价对标DeepSeek,某种程度上是一种“以价换量”的无奈之举——降价会进一步侵蚀本已糟糕的利润率,但不降价,市场份额会被竞争对手蚕食殆尽。
从“拼性能”到“拼性价比”
这场价格战标志着AI大模型竞争的根本性转变。过去两年,行业默认的竞争逻辑是“谁更强谁就能卖更贵”。但OpenAI等巨头大幅降价对标DeepSeek,证明了另一种逻辑正在成为主流:谁能用更低的成本完成同样的任务,谁就能赢得市场。
DeepSeek正在把AI大模型竞争从“拼性能”变成“拼性价比”。模型降价正在推动AI技术普惠,此前业内前沿模型往往闭源且API调用成本高企,使得AI的使用门槛和落地成本较高。而如今,平价化、开源化的模型供给正在有效削减企业研发与运营成本。
单一高价旗舰模型全覆盖的传统模式逐步退场,多模型分工协作、按需调度已成为主流。标准化、低门槛的基础任务交由高性价比开源模型承接,仅在复杂逻辑推理等核心高价值环节调用旗舰模型。
降价潮的局限与未来
旗舰模型的价格堡垒仍在
值得注意的是,OpenAI等巨头大幅降价对标DeepSeek,并未触及旗舰模型的价格体系。GPT-5.6 Sol仍保持每百万输入Token 5美元、输出Token 30美元的价格。Anthropic的Claude Fable 5定价为输入10美元、输出50美元。
旗舰模型仍然是这些厂商最后的利润堡垒。对于那些需要顶尖智能解决疑难任务的场景——复杂代码生成、高难度数学推理、多模态深度思考——旗舰模型仍有不可替代的价值。DeepSeek V4-Flash在智能指数上得50分,而Claude Opus 4.8 Max得56分。虽然50分与56分的差距在性价比面前显得微不足道,但对于某些特定场景,这6分的差距可能决定成败。
缓存依赖的成本陷阱
DeepSeek的价格优势在相当程度上依赖于缓存命中。V4-Flash在长上下文命中缓存时折扣高达98%,输入单价从0.14美元降至0.0028美元/百万Token。但如果使用场景是短请求、高频、上下文各不相同,缓存命中率上不去,实际账单与理论最优值会差出好几倍。
这也是OpenAI等巨头大幅降价对标DeepSeek时可以利用的差异化空间——对于无法充分利用缓存的场景,降价后的Luna可能比DeepSeek更具吸引力。真正的竞争不在于谁的标价更低,而在于谁的“实际完成任务的成本”更低。
价格战远未结束
OpenAI等巨头大幅降价对标DeepSeek,只是这场价格战的开始,而非终点。行业分析认为,这场价格战的本质是两种技术路线的对决——闭源稠密架构 vs 开源MoE架构。只要成本结构的差异存在,价格战就会持续。
对于普通用户和开发者而言,这意味着更便宜的API调用、更便宜的应用和工具。AI推理正在从“奢侈品”变成“日用品”,而这正是OpenAI等巨头大幅降价对标DeepSeek所推动的行业变革。
常见问题(FAQ)
问:OpenAI等巨头大幅降价对标DeepSeek,具体降了多少?
OpenAI将GPT-5.6 Luna价格下调80%,输入从每百万Token 1美元降至0.2美元,输出从6美元降至1.2美元。中端Terra下调20%,输入降至2美元,输出降至12美元。谷歌推出更低价的Gemini 3.6 Flash。Anthropic以更强模型维持原价,变相降价。
问:OpenAI为什么要降价?
直接原因是DeepSeek等中国大模型厂商的持续低价冲击。DeepSeek在2026年5月将V4-Pro永久降价75%,缓存命中价低至每百万Token 0.025元人民币。面对性能接近、价格低几十倍的竞品,OpenAI被迫跟进降价。
问:降价后的OpenAI比DeepSeek便宜吗?
没有。即便降价80%,GPT-5.6 Luna的输出价(1.20美元/百万Token)仍比DeepSeek V4-Flash(0.28美元/百万Token)高出约4倍。DeepSeek还提供约98%的缓存命中折扣。
问:谷歌和Anthropic也降价了吗?
谷歌在OpenAI之前推出了Gemini 3.6 Flash,输出价从9美元降至7.5美元/百万Token。Anthropic没有直接降价,但将Opus 4.8替换为能力更强的Claude 5.0并维持原价。
问:这场价格战对开发者意味着什么?
对开发者而言,这意味着AI推理成本的大幅下降。DeepSeek V4-Flash每次基准测试成本仅3美分,而OpenAI GPT-5.6 Sol需1.86美元。更低的价格意味着更低的AI应用开发门槛和更多的创新空间。
问:旗舰模型会降价吗?
目前不会。OpenAI的GPT-5.6 Sol和Anthropic的Claude Fable 5均维持原价。旗舰模型仍是这些厂商维持利润的核心产品,短期内降价可能性较低。
问:价格战会持续多久?
只要成本结构的差异存在,价格战就会持续。DeepSeek的MoE架构在推理成本上具有结构性优势,而OpenAI等采用稠密架构的厂商在成本上难以匹敌。预计这场价格战将长期持续。

