跳转到正文
全部新闻
INDUSTRY NEWS·July 4, 2026·阅读约 3 分钟

Meta 预告「Watermelon」:为编程打造的高算力 Muse Spark 更新

作者:VCA Newsroom

本文为自动翻译,可能包含错误。 查看英文原文

Meta 正在筹备其旗舰模型 Muse Spark 的新版本,而这一版本明确瞄准了编写软件的人群。首席 AI 官 Alexandr Wang 在 X 上发帖称,这次更新——代号 Watermelon——将带来「编程与智能体能力的重大提升,以便与其他领先模型展开更有力的竞争」,并且它将「很快」通过 Meta AI 和一个全新的 API 面世。目前尚未给出确切日期。

真正的新东西是什么

有两点值得关注。首先,这次更新的运行成本很高:Wang 和后续报道都将 Watermelon 描述为使用了远超初代 Muse Spark 的算力——有一种说法称其算力高出一个「数量级」。这是 Meta 押注于扩大训练与推理算力能直接转化为更强的编程能力。

其次,对「智能体(agentic)」工作的侧重很关键。一个智能体模型不只是回答问题——它会规划、调用工具、编辑文件,并在多个步骤中检查自己的输出。这正是驱动 Claude Code 和 OpenAI 的 Codex 等工具的能力,而这也正是 Meta 一直落后的领域。

与竞争对手相比处在什么位置

初代 Muse Spark 于 2026 年 4 月亮相,在 SWE-Bench Pro 上取得了 52.5% 的成绩——这是一项衡量模型解决真实 GitHub issue 频率的基准测试。作为对比,Computerworld 报道称 GPT-5.5 在同一测试中达到了 58.6%,而 Claude Opus 4.8 则达到了 69.2%。Business Insider 援引匿名消息来源报道称,Watermelon 已经「追平了」GPT-5.5——如果这一说法在正式发布时站得住脚,那么它将弥合 Muse Spark 与 OpenAI 之间的大部分差距,但仍会落后于 Anthropic 的顶级模型。

请谨慎看待这些数字:追平的说法来自不具名消息来源,而非公开发布的基准测试,而且 Meta 尚未公布 Watermelon 自己的成绩。厂商的基准测试宣称,一旦独立测试者运行相同的任务,结果往往会大不相同。

为什么这对构建者很重要

据报道,Meta 正在考虑推出一项 AI 基础设施与编程服务,该服务将与 Claude Code 和 Codex 直接竞争。一家有能力激进定价的公司若能推出一款强大且成本更低的模型,对任何正在学习用 AI 构建的人来说都是好消息:更激烈的竞争往往意味着更便宜的 token 和更慷慨的免费额度。当被问及 Meta 何时能匹敌 Anthropic 的 Claude Opus 4.8 时,Wang 只表示这会「很快」发生。

目前诚实的解读是:这是一个信号,而非已交付的产品。还没有发布日期,没有公开的基准测试,也还没有可供调用的 API。如果你这个月要挑选一款编程助手,请基于今天已经可用且经过衡量的东西来选择——Claude、GPT 以及那些成熟的智能体——等 Watermelon 真正落地、独立测试者给出评价后再重新考虑。但方向已经很清楚:最大的几家实验室如今正在最激烈地争夺的,恰恰是氛围编程者(vibe coder)所依赖的那类智能体编程工作负载。

来源

Auto-generated by Vibe Coding Academy on July 4, 2026, grounded in the real sources linked above. We review for accuracy, but please verify time-sensitive details against the primary sources.

Build Blueprint · Builder

有想法?获取你的 AI 智能体可直接据此构建的规格说明。

描述任意产品,即可获得完整的构建蓝图——技术栈、数据模型、界面、API,以及可直接粘贴到 Claude Code 或 Cursor 的提示词。可导出为 PDF。

打开 Blueprint