Meta计划于10月发布新模型Watermelon:编程与Agent能力将迎史诗级提升

2026年8月25日,据The Information援引内部文件报道,Meta Platforms计划于10月发布其最新AI模型“Watermelon”(西瓜)。Meta计划于10月发布新模型Watermelon的消息紧随其AI代理平台HATCH的推出计划而来——后者最早在未来几周内上线。Watermelon是Muse Spark(内部代号Avocado)的继任者,训练算力比前代高出一个数量级。据Meta超级智能负责人汪滔(Alexandr Wang)在7月内部全员大会上披露,Watermelon已在关键基准测试中追平OpenAI旗舰模型GPT-5.5。Meta计划于10月发布新模型Watermelon,标志着这家社交巨头在AI模型竞赛中正式向OpenAI和Anthropic发起正面挑战。

一、引言:AI牌桌上,Meta终于亮出了底牌
2026年8月25日,一则消息震动全球AI圈——Meta计划于10月发布新模型Watermelon。这不是一次普通的模型迭代。Watermelon是Muse Spark的继任者,而Muse Spark本身是Meta Superintelligence Labs在今年4月发布的首款模型。从4月到10月,仅仅半年时间,Meta就要完成一次“代际跳跃”。
更令人关注的是Watermelon的性能定位。据Business Insider报道,汪滔在7月2日的内部全员大会上向员工透露,正在训练中的Watermelon已在关键基准测试中追平OpenAI的GPT-5.5。如果这一说法经得起独立评估的检验,将意味着Meta首次在模型能力上追平行业最领先的闭源系统。
Meta计划于10月发布新模型Watermelon的消息,正值公司AI战略的关键转折点。一方面,Meta的HATCH AI代理平台即将在未来几周上线;另一方面,扎克伯格刚刚在7月的全员大会上承认,AI代理的进展“并没有像我们预期的那样真正加速”。Watermelon,就是Meta给出的答案。
二、Watermelon是谁:从Avocado到Muse Spark再到“西瓜”的进化之路
2.1 Avocado:一切的开端
要理解Meta计划于10月发布新模型Watermelon的意义,得先从它的“前身”说起。
Avocado(鳄梨/牛油果)是Meta内部对Muse Spark的代号。2026年4月,Meta Superintelligence Labs正式发布了Muse Spark——这是Meta当前模型家族中的首款产品。Muse Spark在基准测试中表现良好,但并没有追平或超过OpenAI、Anthropic等实验室的旗舰模型。
Muse Spark的定位很清晰:证明Meta“还在牌桌上”。它不是一个颠覆者,而是一个宣告——Meta的AI部门已更名为超级智能实验室,由汪滔负责,扎克伯格正全力推动Meta在AI竞赛中取得领先。
2.2 Muse Spark的快速迭代:从1.0到1.2
Muse Spark发布之后,Meta并没有停下脚步。事实上,Meta计划于10月发布新模型Watermelon,只是其AI模型快速迭代节奏的一部分。
- 2026年4月:Muse Spark发布,Meta Superintelligence Labs首款模型
- 2026年7月:Muse Spark 1.1发布,专注于自主编程和桌面控制
- 2026年8月:Muse Spark 1.2与Muse Code一同发布,面向软件工程代理
值得注意的是,Muse Spark 1.2已于2026年8月5日在Meta的API上线,定价为每百万输入token 0.10美元、每百万输出token 0.20美元。Meta还承诺将发布Muse Spark 1.2的开源权重版本。
从4月到8月,四个月时间完成三个版本的迭代——这种速度在AI行业并不多见。而Meta计划于10月发布新模型Watermelon,意味着这种节奏不仅不会放缓,反而在加速。
2.3 Watermelon:算力提升一个数量级的“杀手锏”
那么,Watermelon到底是什么?
汪滔在7月的全员大会上给出了明确的定义:“Watermelon是Avocado之后的下一代模型,目前仍在训练。Watermelon使用的算力比Avocado高出一个数量级。”
“高出一个数量级”——这意味着Watermelon的训练算力大约是Muse Spark的10倍。10倍的算力投入,换来的是什么样的能力提升?据汪滔透露,Watermelon在编程能力和智能体(Agent)能力两方面实现了大幅提升。
汪滔还在社交平台X上公开表示,Muse Spark很快将迎来更新,编程和智能体能力会大幅提升,目标是缩小与竞争对手模型的差距。有用户询问Meta何时能推出比肩Anthropic Claude Opus的编程模型,汪滔的回答是:“很快。你们会喜欢我们接下来拿出的成果。”
三、性能对标GPT-5.5:Meta的“追赶宣言”
3.1 追上GPT-5.5意味着什么?
Meta计划于10月发布新模型Watermelon,最引人注目的信息是它的性能定位——追平GPT-5.5。
GPT-5.5是OpenAI在2026年4月发布的旗舰模型。虽然OpenAI在6月底又推出了GPT-5.6,但因美国政府以国家安全为由要求暂缓全面开放,GPT-5.6并未向公众广泛提供。因此,GPT-5.5目前仍是市场上可用的最强模型之一。
汪滔在内部大会上表示,Watermelon“已在备受关注的基准测试中追平OpenAI旗舰模型GPT-5.5”。不过,他没有说明具体采用了哪些测试项目。这意味着Watermelon的性能对标目前还无法被独立验证。
但即便存在这些不确定性,如果Watermelon真的达到GPT-5.5水平,也将是Meta AI能力的巨大飞跃。要知道,Muse Spark在发布时并未追平或超过OpenAI、Anthropic的模型。从“没追上”到“追平”,Meta计划于10月发布新模型Watermelon,本身就是一次战略性的能力跃迁。
3.2 算力“军备竞赛”:10倍算力从何而来?
10倍的算力提升不是凭空变出来的。它背后是Meta庞大的基础设施投资。
汪滔所说的“高出一个数量级”的算力,只有在Meta大规模AI基础设施的背景下才能理解。2026年全年,Meta预计将在芯片、数据中心和其他基础设施上投入1250亿至1450亿美元。其中,位于路易斯安那州里奇兰教区的Hyperion数据中心项目,总投资已从2024年公布的100亿美元提高至最高500亿美元。该数据中心的规划容量提升至5吉瓦(GW)。
Meta还拥有约60万块H100等效GPU已在运行中。如此庞大的算力储备,为Watermelon的10倍算力训练提供了物质基础。
Meta计划于10月发布新模型Watermelon,本质上是在用“算力换能力”——通过更大规模的训练投入,追赶OpenAI和Anthropic在模型能力上的领先优势。
3.3 一个值得注意的细节:对标5.5而非5.6
Meta计划于10月发布新模型Watermelon,对标的是GPT-5.5,而不是更新的GPT-5.6。这个细节值得玩味。
GPT-5.6虽然已经发布,但因美国政府的要求暂未向公众全面开放。选择对标GPT-5.5而非5.6,一方面说明Meta可能还没有足够的数据来对标5.6,另一方面也意味着Watermelon的目标是“追上当前可用的最强模型”,而不是“追上OpenAI实验室里最新的模型”。
当然,AI基准测试的选择本身就是一个充满争议的话题。基准测试的选择性(cherry-picking)在行业内并不少见。内部全员大会上的表态,其分量也不如同行评审或第三方评测榜单。Meta计划于10月发布新模型Watermelon之后,真正的考验在于独立第三方的评测结果。
四、横向对比:Watermelon与主要竞品的全面较量
| 对比维度 | Meta Watermelon | OpenAI GPT-5.5 | OpenAI GPT-5.6 | Anthropic Claude Opus 4.6 | Google Gemini 3.1 Pro | Meta Muse Spark |
|---|---|---|---|---|---|---|
| 发布/计划时间 | 2026年10月 | 2026年4月 | 2026年6月(受限发布) | 2026年 | 2026年 | 2026年4月 |
| 训练算力(vs前代) | 10倍于Muse Spark | 未公开 | 未公开 | 未公开 | 未公开 | 基准 |
| 性能定位 | 追平GPT-5.5 | 旗舰基准 | 强于5.5(受限) | 代码能力突出 | 多模态强 | 良好但未追平竞品 |
| 核心提升方向 | 编程能力+Agent能力 | 通用推理 | 安全增强 | 代码生成 | 搜索整合 | 基础能力 |
| 开源策略 | 未明确(Muse Spark 1.2开源) | 闭源 | 闭源 | 闭源 | 部分开放 | 部分开源 |
| 生态整合 | HATCH平台+WhatsApp+Instagram | ChatGPT生态 | ChatGPT生态 | Claude生态 | Google生态 | Meta生态 |
| Intelligence Index评分 | 待验证 | 59 | 未公开 | 53 | 57 | 低于以上 |
数据解读:
这张表格清晰地展示了Meta计划于10月发布新模型Watermelon在整个AI竞争格局中的位置。
性能层面,Watermelon的目标是追平GPT-5.5(Intelligence Index评分59)。这意味着它要超越Claude Opus 4.6(53分)和Gemini 3.1 Pro(57分)。如果这一目标实现,Watermelon将成为仅次于GPT-5.6的全球第二强模型。
算力投入层面,Watermelon的10倍算力训练规模在表格中显得格外突出。这不是渐进式改进,而是跳跃式投入——Meta在用真金白银堆出一个“追赶者”的资格。
差异化层面,Watermelon的重点提升方向是编程能力和Agent能力。这并非偶然——HATCH平台的推出需要强大的Agent能力支撑,而编程能力则是争夺开发者生态的关键。
五、Watermelon的战略意义:不只是“又一个模型”
5.1 为HATCH提供“大脑”
Meta计划于10月发布新模型Watermelon,与HATCH平台的推出时间紧密相连。
HATCH是Meta的消费级AI代理平台,脱胎于开源项目OpenClaw,预计最早在未来几周内(8月底或9月初)上线。HATCH经过训练,能够访问DoorDash、Etsy、Reddit、Yelp和Outlook等外部网站并直接互动。
但HATCH目前运行在什么模型上?据The Information此前报道,Meta正在训练受OpenClaw启发的AI代理HATCH。虽然目前的HATCH可能还在使用其他模型(有报道称HATCH运行在Anthropic的Claude模型上),但Meta计划于10月发布新模型Watermelon,几乎可以肯定是为HATCH准备“自研大脑”。
汪滔在7月的全员大会上同时透露了两个信息:Watermelon追平GPT-5.5,以及Muse Spark即将迎来“编程和智能体能力的大幅提升”。这两个信息指向同一个方向——Meta正在为HATCH打造一个强大的、自研的AI引擎。
5.2 从“免费AI”到“付费生态”的关键拼图
Meta计划于10月发布新模型Watermelon,还承载着更重要的商业化使命。
HATCH是扎克伯格“将公司巨额AI投资变现、拓展广告以外多元化收入来源”战略的核心。据报道,Meta考虑采用分级定价体系,高级版月度订阅费最高可达199.99美元。
但是,要让用户愿意为HATCH付费,HATCH的能力必须足够强。而HATCH的能力上限,很大程度上取决于底层模型的能力。如果HATCH运行的是Claude或GPT,Meta不仅要支付高昂的API费用,还无法形成差异化优势。
Meta计划于10月发布新模型Watermelon,正是要解决这个问题——用自研的、追平GPT-5.5的模型,驱动自研的AI代理平台HATCH。从模型到平台,从技术到商业,形成一个完整的闭环。
5.3 开源与闭源的“双轨战略”
值得注意的是,Meta计划于10月发布新模型Watermelon,并不意味着Meta放弃了开源路线。
实际上,Meta正在执行一条“双轨战略”:一方面推动Muse Spark 1.2等闭源模型的商业化;另一方面继续保持在开源领域的存在,最近推出了更小的开源模型Muse Glimmer,并承诺发布Muse Spark 1.2的开源权重版本。
扎克伯格本人也亲自撰文倡导开源AI的可及性。Meta的战略很清晰:用闭源模型做商业化、用开源模型保开发者生态。
Meta计划于10月发布新模型Watermelon之后,它是否会开源?目前尚不明确。但考虑到Muse Spark 1.2已经开源,Watermelon至少部分开源的可能性是存在的。
六、挑战与悬念:Watermelon面前的未知数
6.1 独立验证的“信任鸿沟”
Meta计划于10月发布新模型Watermelon,最大的悬念在于:它真的追平了GPT-5.5吗?
目前所有的信息都来自汪滔在内部全员大会上的表态,以及Business Insider等媒体的报道。具体的基准测试项目并未公开。在独立第三方评测之前,这些说法都只是“Meta的一面之词”。
AI基准测试的选择性(cherry-picking)在行业内是公开的秘密。一个模型可以在某些特定测试中表现优异,但在实际应用中表现平平。内部全员大会上的表态,其可信度也不如同行评审或第三方评测榜单。
因此,Meta计划于10月发布新模型Watermelon之后,真正的考验才刚刚开始——它需要在MMLU、GSM8K、HumanEval等公开基准上接受检验,更需要在实际应用中证明自己的价值。
6.2 “追上5.5”够不够?
另一个值得思考的问题是:即使Watermelon真的追平了GPT-5.5,这够吗?
OpenAI在2026年6月已经推出了GPT-5.6。虽然GPT-5.6因美国政府要求暂未全面开放,但OpenAI的研发并没有停止。到2026年10月Watermelon正式发布时,OpenAI可能已经有了GPT-5.7甚至6.0。
Meta计划于10月发布新模型Watermelon,对标的是一个已经存在了6个月的模型(GPT-5.5于4月发布)。在AI行业“按月迭代”的节奏下,6个月是一段很长的时间。Watermelon能否在发布时仍然具有竞争力,是一个巨大的问号。
6.3 10倍算力的“性价比”之问
Watermelon使用了10倍于Muse Spark的算力。这是一个令人印象深刻的数字,但也引出了一个关键问题:10倍的算力投入,换来了多少倍的性能提升?
从Muse Spark“未追平竞品”到Watermelon“追平GPT-5.5”,性能确实有了质的飞跃。但10倍的算力投入是否“值得”?在“ Scaling Laws”(规模法则)遭遇边际效益递减的争议背景下,Meta的选择是押注“更多算力=更强模型”这一方向。Meta计划于10月发布新模型Watermelon,正是这一战略的集中体现。
6.4 独到见解:Watermelon的真正对手或许不是GPT
很多分析把Watermelon和GPT-5.5放在一起比较。但在我看来,Meta计划于10月发布新模型Watermelon,真正的竞争维度可能不在“模型能力”本身,而在“模型+平台+生态”的组合拳。
OpenAI有ChatGPT,但没有社交网络。Anthropic有Claude,但同样没有用户生态。而Meta有Facebook、Instagram、WhatsApp——合计超过30亿日活用户。
Watermelon的真正价值,不在于它在某个基准测试上比GPT-5.5高几分,而在于它能否让HATCH在Instagram和WhatsApp上跑出让人惊艳的体验。如果Watermelon驱动的AI购物代理能让用户在刷Reels时“一键下单”,如果Watermelon驱动的WhatsApp AI代理能让用户在聊天中“顺手办事”——那才是Meta真正的“杀手锏”。
七、结语:Watermelon之后,Meta能翻盘吗?
2026年8月,Meta计划于10月发布新模型Watermelon的消息传遍科技圈。从Avocado到Muse Spark,从Muse Spark 1.1到1.2,再到Watermelon——Meta在不到一年的时间里完成了五代模型的迭代。
10倍的算力、追平GPT-5.5的性能、编程与Agent能力的双重提升——Watermelon的“纸面参数”足够漂亮。但真正的考验还在后面:独立评测能否验证这些说法?Watermelon能否在HATCH平台上兑现它的能力?Meta能否通过“模型+平台+生态”的组合拳,在AI商业化上走出一条不同于OpenAI的路?
Meta计划于10月发布新模型Watermelon,只是这场漫长竞赛中的一个节点。前方的路还很长,但至少有一点是确定的——在AI的牌桌上,Meta不仅还在,而且正在加注。
FAQ:关于Meta Watermelon模型的常见问题
问:Meta计划于10月发布新模型Watermelon的具体时间是什么?
答:据The Information援引内部文件报道,Meta计划于2026年10月发布最新AI模型“Watermelon”。不过内部文件并未说明该模型将整合至现有模型系列中,还是作为独立系统推出。
问:Watermelon和Muse Spark是什么关系?
答:Watermelon是Muse Spark(内部代号Avocado)的继任者。Muse Spark于2026年4月发布,是Meta当前模型家族的首款产品。Watermelon是Muse Spark之后的下一代模型。
问:Watermelon的性能如何?
答:据Meta超级智能负责人汪滔在7月内部全员大会上透露,Watermelon已在关键基准测试中追平OpenAI的GPT-5.5。不过具体的基准测试项目并未公开。
问:Watermelon用了多少算力?
答:汪滔表示,Watermelon使用的算力比前代Avocado(Muse Spark)高出一个数量级,即约10倍。
问:Watermelon主要提升在哪些方面?
答:Watermelon主要在编程能力(Coding)和智能体能力(Agentic Capabilities)两方面实现了大幅提升。这与Meta即将推出的HATCH AI代理平台的需求高度吻合。
问:Watermelon会开源吗?
答:目前尚不明确。Meta正在执行“双轨战略”——闭源模型做商业化、开源模型保开发者生态。Muse Spark 1.2已承诺发布开源权重版本,但Watermelon是否开源尚未公布。
问:Watermelon和HATCH是什么关系?
答:HATCH是Meta的消费级AI代理平台,预计在未来几周内上线。Watermelon预计在10月发布。虽然两者发布时间略有先后,但Watermelon几乎可以肯定是为HATCH等AI代理产品提供底层模型能力。
问:Watermelon对标GPT-5.5,为什么不直接对标GPT-5.6?
答:GPT-5.6于2026年6月底发布,但因美国政府以国家安全为由要求暂缓全面开放,并未向公众广泛提供。因此GPT-5.5目前仍是市场上可用的最强模型之一。选择对标GPT-5.5而非5.6,可能是因为Meta的训练数据主要基于可用的公开模型进行对标。

