文章摘要
近期,DeepSeek V4 Pro正式版发布,引发全球AI行业关注。其实测性能亮眼,多项评测追平或超越海外旗舰模型。其定价仅为$0.87/1M tokens,极致性价比将推动全球AI产业成本重构。当前海外企业AI成本压力大,此前已有开发者转向国产大模型,V4 Pro发布后更受关注,这也让海外头部厂商面临巨大竞争压力。

近期DeepSeek V4 Pro正式版发布,这款产品的性能表现直接对标高价海外旗舰模型,在全球AI行业引发了广泛关注。

从实测数据来看,这款新模型的表现远超预期,并非夸大其词。此前的DeepSeek V4 Flash正式版就已经具备不错的基础性能,而此次推出的Pro版本,在多项核心评测中实现了对海外旗舰模型的超越。

实测性能亮眼

在Agent自动化评测榜单AutomationBench上,V4 Pro拿到31.8分,直接超过了Fable5。在最受关注的终端操作测试Terminal Bench 2.1中,V4 Pro拿下87.9分,仅比Anthropic旗下最贵最强的旗舰模型Fable5低0.1分,几乎追平了这款顶级产品。

更值得一提的是网络安全评测场景:Cybergym是网络安全领域的顶级测试项目,Anthropic此前发布Fable5时,正是以该测试的出色表现作为核心宣传点,称其网络安全能力独树一帜。而此次V4 Pro在该测试中拿到83.3分,反而反超了Fable5的83.1分。

当然,单一跑分不能完全代表模型的全部实力。据行业从业者反馈,此前使用DeepSeek V4 Flash的团队普遍认为,该模型基础性能出色且成本可控,仅在复杂任务场景下与Fable5、Opus 4.8等顶级模型存在一定差距。而此次V4 Pro的纸面性能实现了全面碾压,结合V4 Flash的优秀底子来看,V4 Pro至少达到了顶流模型的中段水准,甚至可以对标Opus 4.8。

极致性价比重塑行业标尺

V4 Pro的性能接近Opus 4.8,但两者的价格却有着天壤之别:Opus 4.8的定价为$25/1M tokens,此前不少用户都反馈使用成本过高;而Fable5的定价更是达到了$50/1M tokens,让很多企业在使用前都需要仔细权衡成本。

DeepSeek V4 Pro的定价仅为$0.87/1M tokens,换算下来仅约六元人民币,仅为Fable5定价的五十七分之一。这个价格差距意味着,即便两者存在一定性能差距,但在多数常规任务中,V4 Pro可以做到与海外旗舰模型相当的表现,却只需要极低的成本。

有团队此前已经将业务迁移到DeepSeek V4 Flash,使用成本从每日100美金降至仅两到三美金。而升级到V4 Pro后,成本涨幅有限,但性能却得到了大幅提升。

此前就有行业观点指出,DeepSeek已经重新定义了大模型的价格斩杀线:如果一款大模型的性价比达不到V4系列的水平,就会被市场淘汰;即便性能稍好,但价格高出数倍的产品,也将面临极大的竞争压力。此次V4 Pro的推出,无疑会进一步推动全球AI产业的成本重构,整个行业都可能因此发生深刻变化。

搅动全球AI市场格局

当前海外企业正面临着AI token成本的巨大压力:2026年前四个月,某头部出行平台就已经烧完了全年的AI token预算;另一大型企业每年需要向海外头部厂商支付近3亿美金的大模型服务费用。在这样的成本压力下,企业很难再为仅领先一小截的性能,支付数十倍的价格。

事实上,早在V4 Pro发布之前,就已经有大量开发者开始转向国产大模型。随着多款国产开源模型的崛起,包括多家海外企业在内的市场主体,已经将后台批量任务迁移到国产模型上,实现了生产环境的实际切换。

此次V4 Pro正式版发布后,据行业人士反馈,已有多位创业者表示将尽快升级到V4 Pro,将高性价比的AI服务提供给更多用户;还有创业者计划基于国产开源大模型进行推理优化,进一步降低使用成本。

在这样的背景下,两大海外头部AI厂商无疑面临着巨大的竞争压力:在性能差距不大的情况下,价格差距如此悬殊,这两家厂商接下来将如何调整策略,值得行业持续关注。

以上内容不代表本平台立场,仅供读者参考