文章摘要
2026年8月25日消息,Meta计划10月发布新AI模型Watermelon,它是MuseSpark继任者,训练算力高10倍。据汪滔透露,其已追平GPT-5.5。该模型编程与Agent能力大幅提升,或为即将上线的HATCH平台提供“大脑”,承载商业化使命。不过其性能待独立验证,且面临算力性价比等问题。

2026年8月25日,据The Information援引内部文件报道,Meta Platforms计划于10月发布其最新AI模型“Watermelon”(西瓜)。Meta计划于10月发布新模型Watermelon的消息紧随其AI代理平台HATCH的推出计划而来——后者最早在未来几周内上线。Watermelon是Muse Spark(内部代号Avocado)的继任者,训练算力比前代高出一个数量级。据Meta超级智能负责人汪滔(Alexandr Wang)在7月内部全员大会上披露,Watermelon已在关键基准测试中追平OpenAI旗舰模型GPT-5.5。Meta计划于10月发布新模型Watermelon,标志着这家社交巨头在AI模型竞赛中正式向OpenAI和Anthropic发起正面挑战。

Meta计划于10月发布新模型Watermelon

一、引言:AI牌桌上,Meta终于亮出了底牌

2026年8月25日,一则消息震动全球AI圈——Meta计划于10月发布新模型Watermelon。这不是一次普通的模型迭代。Watermelon是Muse Spark的继任者,而Muse Spark本身是Meta Superintelligence Labs在今年4月发布的首款模型。从4月到10月,仅仅半年时间,Meta就要完成一次“代际跳跃”。

更令人关注的是Watermelon的性能定位。据Business Insider报道,汪滔在7月2日的内部全员大会上向员工透露,正在训练中的Watermelon已在关键基准测试中追平OpenAI的GPT-5.5。如果这一说法经得起独立评估的检验,将意味着Meta首次在模型能力上追平行业最领先的闭源系统。

Meta计划于10月发布新模型Watermelon的消息,正值公司AI战略的关键转折点。一方面,Meta的HATCH AI代理平台即将在未来几周上线;另一方面,扎克伯格刚刚在7月的全员大会上承认,AI代理的进展“并没有像我们预期的那样真正加速”。Watermelon,就是Meta给出的答案。

二、Watermelon是谁:从Avocado到Muse Spark再到“西瓜”的进化之路

2.1 Avocado:一切的开端

要理解Meta计划于10月发布新模型Watermelon的意义,得先从它的“前身”说起。

Avocado(鳄梨/牛油果)是Meta内部对Muse Spark的代号。2026年4月,Meta Superintelligence Labs正式发布了Muse Spark——这是Meta当前模型家族中的首款产品。Muse Spark在基准测试中表现良好,但并没有追平或超过OpenAI、Anthropic等实验室的旗舰模型。

Muse Spark的定位很清晰:证明Meta“还在牌桌上”。它不是一个颠覆者,而是一个宣告——Meta的AI部门已更名为超级智能实验室,由汪滔负责,扎克伯格正全力推动Meta在AI竞赛中取得领先。

2.2 Muse Spark的快速迭代:从1.0到1.2

Muse Spark发布之后,Meta并没有停下脚步。事实上,Meta计划于10月发布新模型Watermelon,只是其AI模型快速迭代节奏的一部分。

  • 2026年4月:Muse Spark发布,Meta Superintelligence Labs首款模型
  • 2026年7月:Muse Spark 1.1发布,专注于自主编程和桌面控制
  • 2026年8月:Muse Spark 1.2与Muse Code一同发布,面向软件工程代理

值得注意的是,Muse Spark 1.2已于2026年8月5日在Meta的API上线,定价为每百万输入token 0.10美元、每百万输出token 0.20美元。Meta还承诺将发布Muse Spark 1.2的开源权重版本。

从4月到8月,四个月时间完成三个版本的迭代——这种速度在AI行业并不多见。而Meta计划于10月发布新模型Watermelon,意味着这种节奏不仅不会放缓,反而在加速。

2.3 Watermelon:算力提升一个数量级的“杀手锏”

那么,Watermelon到底是什么?

汪滔在7月的全员大会上给出了明确的定义:“Watermelon是Avocado之后的下一代模型,目前仍在训练。Watermelon使用的算力比Avocado高出一个数量级。”

“高出一个数量级”——这意味着Watermelon的训练算力大约是Muse Spark的10倍。10倍的算力投入,换来的是什么样的能力提升?据汪滔透露,Watermelon在编程能力和智能体(Agent)能力两方面实现了大幅提升。

汪滔还在社交平台X上公开表示,Muse Spark很快将迎来更新,编程和智能体能力会大幅提升,目标是缩小与竞争对手模型的差距。有用户询问Meta何时能推出比肩Anthropic Claude Opus的编程模型,汪滔的回答是:“很快。你们会喜欢我们接下来拿出的成果。”

三、性能对标GPT-5.5:Meta的“追赶宣言”

3.1 追上GPT-5.5意味着什么?

Meta计划于10月发布新模型Watermelon,最引人注目的信息是它的性能定位——追平GPT-5.5。

GPT-5.5是OpenAI在2026年4月发布的旗舰模型。虽然OpenAI在6月底又推出了GPT-5.6,但因美国政府以国家安全为由要求暂缓全面开放,GPT-5.6并未向公众广泛提供。因此,GPT-5.5目前仍是市场上可用的最强模型之一。

汪滔在内部大会上表示,Watermelon“已在备受关注的基准测试中追平OpenAI旗舰模型GPT-5.5”。不过,他没有说明具体采用了哪些测试项目。这意味着Watermelon的性能对标目前还无法被独立验证。

但即便存在这些不确定性,如果Watermelon真的达到GPT-5.5水平,也将是Meta AI能力的巨大飞跃。要知道,Muse Spark在发布时并未追平或超过OpenAI、Anthropic的模型。从“没追上”到“追平”,Meta计划于10月发布新模型Watermelon,本身就是一次战略性的能力跃迁。

3.2 算力“军备竞赛”:10倍算力从何而来?

10倍的算力提升不是凭空变出来的。它背后是Meta庞大的基础设施投资。

汪滔所说的“高出一个数量级”的算力,只有在Meta大规模AI基础设施的背景下才能理解。2026年全年,Meta预计将在芯片、数据中心和其他基础设施上投入1250亿至1450亿美元。其中,位于路易斯安那州里奇兰教区的Hyperion数据中心项目,总投资已从2024年公布的100亿美元提高至最高500亿美元。该数据中心的规划容量提升至5吉瓦(GW)。

Meta还拥有约60万块H100等效GPU已在运行中。如此庞大的算力储备,为Watermelon的10倍算力训练提供了物质基础。

Meta计划于10月发布新模型Watermelon,本质上是在用“算力换能力”——通过更大规模的训练投入,追赶OpenAI和Anthropic在模型能力上的领先优势。

3.3 一个值得注意的细节:对标5.5而非5.6

Meta计划于10月发布新模型Watermelon,对标的是GPT-5.5,而不是更新的GPT-5.6。这个细节值得玩味。

GPT-5.6虽然已经发布,但因美国政府的要求暂未向公众全面开放。选择对标GPT-5.5而非5.6,一方面说明Meta可能还没有足够的数据来对标5.6,另一方面也意味着Watermelon的目标是“追上当前可用的最强模型”,而不是“追上OpenAI实验室里最新的模型”。

当然,AI基准测试的选择本身就是一个充满争议的话题。基准测试的选择性(cherry-picking)在行业内并不少见。内部全员大会上的表态,其分量也不如同行评审或第三方评测榜单。Meta计划于10月发布新模型Watermelon之后,真正的考验在于独立第三方的评测结果。

四、横向对比:Watermelon与主要竞品的全面较量

对比维度 Meta Watermelon OpenAI GPT-5.5 OpenAI GPT-5.6 Anthropic Claude Opus 4.6 Google Gemini 3.1 Pro Meta Muse Spark
发布/计划时间 2026年10月 2026年4月 2026年6月(受限发布) 2026年 2026年 2026年4月
训练算力(vs前代) 10倍于Muse Spark 未公开 未公开 未公开 未公开 基准
性能定位 追平GPT-5.5 旗舰基准 强于5.5(受限) 代码能力突出 多模态强 良好但未追平竞品
核心提升方向 编程能力+Agent能力 通用推理 安全增强 代码生成 搜索整合 基础能力
开源策略 未明确(Muse Spark 1.2开源) 闭源 闭源 闭源 部分开放 部分开源
生态整合 HATCH平台+WhatsApp+Instagram ChatGPT生态 ChatGPT生态 Claude生态 Google生态 Meta生态
Intelligence Index评分 待验证 59 未公开 53 57 低于以上

数据解读:

这张表格清晰地展示了Meta计划于10月发布新模型Watermelon在整个AI竞争格局中的位置。

性能层面,Watermelon的目标是追平GPT-5.5(Intelligence Index评分59)。这意味着它要超越Claude Opus 4.6(53分)和Gemini 3.1 Pro(57分)。如果这一目标实现,Watermelon将成为仅次于GPT-5.6的全球第二强模型。

算力投入层面,Watermelon的10倍算力训练规模在表格中显得格外突出。这不是渐进式改进,而是跳跃式投入——Meta在用真金白银堆出一个“追赶者”的资格。

差异化层面,Watermelon的重点提升方向是编程能力和Agent能力。这并非偶然——HATCH平台的推出需要强大的Agent能力支撑,而编程能力则是争夺开发者生态的关键。

五、Watermelon的战略意义:不只是“又一个模型”

5.1 为HATCH提供“大脑”

Meta计划于10月发布新模型Watermelon,与HATCH平台的推出时间紧密相连。

HATCH是Meta的消费级AI代理平台,脱胎于开源项目OpenClaw,预计最早在未来几周内(8月底或9月初)上线。HATCH经过训练,能够访问DoorDash、Etsy、Reddit、Yelp和Outlook等外部网站并直接互动。

但HATCH目前运行在什么模型上?据The Information此前报道,Meta正在训练受OpenClaw启发的AI代理HATCH。虽然目前的HATCH可能还在使用其他模型(有报道称HATCH运行在Anthropic的Claude模型上),但Meta计划于10月发布新模型Watermelon,几乎可以肯定是为HATCH准备“自研大脑”。

汪滔在7月的全员大会上同时透露了两个信息:Watermelon追平GPT-5.5,以及Muse Spark即将迎来“编程和智能体能力的大幅提升”。这两个信息指向同一个方向——Meta正在为HATCH打造一个强大的、自研的AI引擎。

5.2 从“免费AI”到“付费生态”的关键拼图

Meta计划于10月发布新模型Watermelon,还承载着更重要的商业化使命。

HATCH是扎克伯格“将公司巨额AI投资变现、拓展广告以外多元化收入来源”战略的核心。据报道,Meta考虑采用分级定价体系,高级版月度订阅费最高可达199.99美元。

但是,要让用户愿意为HATCH付费,HATCH的能力必须足够强。而HATCH的能力上限,很大程度上取决于底层模型的能力。如果HATCH运行的是Claude或GPT,Meta不仅要支付高昂的API费用,还无法形成差异化优势。

Meta计划于10月发布新模型Watermelon,正是要解决这个问题——用自研的、追平GPT-5.5的模型,驱动自研的AI代理平台HATCH。从模型到平台,从技术到商业,形成一个完整的闭环。

5.3 开源与闭源的“双轨战略”

值得注意的是,Meta计划于10月发布新模型Watermelon,并不意味着Meta放弃了开源路线。

实际上,Meta正在执行一条“双轨战略”:一方面推动Muse Spark 1.2等闭源模型的商业化;另一方面继续保持在开源领域的存在,最近推出了更小的开源模型Muse Glimmer,并承诺发布Muse Spark 1.2的开源权重版本。

扎克伯格本人也亲自撰文倡导开源AI的可及性。Meta的战略很清晰:用闭源模型做商业化、用开源模型保开发者生态。

Meta计划于10月发布新模型Watermelon之后,它是否会开源?目前尚不明确。但考虑到Muse Spark 1.2已经开源,Watermelon至少部分开源的可能性是存在的。

六、挑战与悬念:Watermelon面前的未知数

6.1 独立验证的“信任鸿沟”

Meta计划于10月发布新模型Watermelon,最大的悬念在于:它真的追平了GPT-5.5吗?

目前所有的信息都来自汪滔在内部全员大会上的表态,以及Business Insider等媒体的报道。具体的基准测试项目并未公开。在独立第三方评测之前,这些说法都只是“Meta的一面之词”。

AI基准测试的选择性(cherry-picking)在行业内是公开的秘密。一个模型可以在某些特定测试中表现优异,但在实际应用中表现平平。内部全员大会上的表态,其可信度也不如同行评审或第三方评测榜单。

因此,Meta计划于10月发布新模型Watermelon之后,真正的考验才刚刚开始——它需要在MMLU、GSM8K、HumanEval等公开基准上接受检验,更需要在实际应用中证明自己的价值。

6.2 “追上5.5”够不够?

另一个值得思考的问题是:即使Watermelon真的追平了GPT-5.5,这够吗?

OpenAI在2026年6月已经推出了GPT-5.6。虽然GPT-5.6因美国政府要求暂未全面开放,但OpenAI的研发并没有停止。到2026年10月Watermelon正式发布时,OpenAI可能已经有了GPT-5.7甚至6.0。

Meta计划于10月发布新模型Watermelon,对标的是一个已经存在了6个月的模型(GPT-5.5于4月发布)。在AI行业“按月迭代”的节奏下,6个月是一段很长的时间。Watermelon能否在发布时仍然具有竞争力,是一个巨大的问号。

6.3 10倍算力的“性价比”之问

Watermelon使用了10倍于Muse Spark的算力。这是一个令人印象深刻的数字,但也引出了一个关键问题:10倍的算力投入,换来了多少倍的性能提升?

从Muse Spark“未追平竞品”到Watermelon“追平GPT-5.5”,性能确实有了质的飞跃。但10倍的算力投入是否“值得”?在“ Scaling Laws”(规模法则)遭遇边际效益递减的争议背景下,Meta的选择是押注“更多算力=更强模型”这一方向。Meta计划于10月发布新模型Watermelon,正是这一战略的集中体现。

6.4 独到见解:Watermelon的真正对手或许不是GPT

很多分析把Watermelon和GPT-5.5放在一起比较。但在我看来,Meta计划于10月发布新模型Watermelon,真正的竞争维度可能不在“模型能力”本身,而在“模型+平台+生态”的组合拳

OpenAI有ChatGPT,但没有社交网络。Anthropic有Claude,但同样没有用户生态。而Meta有Facebook、Instagram、WhatsApp——合计超过30亿日活用户

Watermelon的真正价值,不在于它在某个基准测试上比GPT-5.5高几分,而在于它能否让HATCH在Instagram和WhatsApp上跑出让人惊艳的体验。如果Watermelon驱动的AI购物代理能让用户在刷Reels时“一键下单”,如果Watermelon驱动的WhatsApp AI代理能让用户在聊天中“顺手办事”——那才是Meta真正的“杀手锏”。

七、结语:Watermelon之后,Meta能翻盘吗?

2026年8月,Meta计划于10月发布新模型Watermelon的消息传遍科技圈。从Avocado到Muse Spark,从Muse Spark 1.1到1.2,再到Watermelon——Meta在不到一年的时间里完成了五代模型的迭代。

10倍的算力、追平GPT-5.5的性能、编程与Agent能力的双重提升——Watermelon的“纸面参数”足够漂亮。但真正的考验还在后面:独立评测能否验证这些说法?Watermelon能否在HATCH平台上兑现它的能力?Meta能否通过“模型+平台+生态”的组合拳,在AI商业化上走出一条不同于OpenAI的路?

Meta计划于10月发布新模型Watermelon,只是这场漫长竞赛中的一个节点。前方的路还很长,但至少有一点是确定的——在AI的牌桌上,Meta不仅还在,而且正在加注。

FAQ:关于Meta Watermelon模型的常见问题

问:Meta计划于10月发布新模型Watermelon的具体时间是什么?

答:据The Information援引内部文件报道,Meta计划于2026年10月发布最新AI模型“Watermelon”。不过内部文件并未说明该模型将整合至现有模型系列中,还是作为独立系统推出。

问:Watermelon和Muse Spark是什么关系?

答:Watermelon是Muse Spark(内部代号Avocado)的继任者。Muse Spark于2026年4月发布,是Meta当前模型家族的首款产品。Watermelon是Muse Spark之后的下一代模型。

问:Watermelon的性能如何?

答:据Meta超级智能负责人汪滔在7月内部全员大会上透露,Watermelon已在关键基准测试中追平OpenAI的GPT-5.5。不过具体的基准测试项目并未公开。

问:Watermelon用了多少算力?

答:汪滔表示,Watermelon使用的算力比前代Avocado(Muse Spark)高出一个数量级,即约10倍。

问:Watermelon主要提升在哪些方面?

答:Watermelon主要在编程能力(Coding)和智能体能力(Agentic Capabilities)两方面实现了大幅提升。这与Meta即将推出的HATCH AI代理平台的需求高度吻合。

问:Watermelon会开源吗?

答:目前尚不明确。Meta正在执行“双轨战略”——闭源模型做商业化、开源模型保开发者生态。Muse Spark 1.2已承诺发布开源权重版本,但Watermelon是否开源尚未公布。

问:Watermelon和HATCH是什么关系?

答:HATCH是Meta的消费级AI代理平台,预计在未来几周内上线。Watermelon预计在10月发布。虽然两者发布时间略有先后,但Watermelon几乎可以肯定是为HATCH等AI代理产品提供底层模型能力。

问:Watermelon对标GPT-5.5,为什么不直接对标GPT-5.6?

答:GPT-5.6于2026年6月底发布,但因美国政府以国家安全为由要求暂缓全面开放,并未向公众广泛提供。因此GPT-5.5目前仍是市场上可用的最强模型之一。选择对标GPT-5.5而非5.6,可能是因为Meta的训练数据主要基于可用的公开模型进行对标。

以上内容不代表本平台立场,仅供读者参考