Claude又曝新模型:Marshmallow与Melon现身,Anthropic为何加速迭代?

8月24日,有开发者在Anthropic API中发现了两个此前未公开的模型代号:claude-marshmallow-eap和claude-melon-eap。其中,EAP通常指Early Access Program(早期访问计划),意味着相关模型可能已经进入有限范围的测试阶段。多名开发者也在社区和Discord中确认了这两个代号的出现。
目前,Anthropic并没有公开确认Marshmallow和Melon的产品定位、发布时间或具体能力,两款模型也没有出现在官方公开模型列表中。因此,现阶段更准确的说法是:Anthropic内部又出现了两个正在测试的新模型。
但这次曝光仍然值得关注。
就在一个月前,Anthropic刚刚发布Claude Opus 5。官方将其定位为面向长时间运行Agent、编程和专业工作的旗舰模型。
01 API里出现两个新代号,Marshmallow和Melon是什么?
目前能够确认的信息并不多。
开发者发现的两个标识分别是claude-marshmallow-eap和claude-melon-eap。从命名方式来看,它们更像内部测试阶段使用的checkpoint或模型代号,而不是最终产品名称。
这类代号本身并不能直接对应最终产品。
此前Anthropic内部也出现过类似情况。模型进入测试阶段后,开发者可能通过API、合作平台或软件代码中的标识发现尚未公开的模型。部分内部模型最终会正式发布,也有一些会继续迭代、改名,甚至不会进入公开产品线。
目前官方公开模型列表中,Anthropic仍将Claude Fable 5、Claude Opus 5、Claude Sonnet 5和Claude Haiku 4.5列为主要产品。Marshmallow和Melon尚未出现在官方模型文档中。
因此,Marshmallow和Melon究竟对应Opus、Sonnet还是其他产品线,现在还无法确定。
02 Marshmallow为什么受到关注?
真正让这次曝光迅速传播的,是早期测试反馈。
据目前流出的社区信息,Marshmallow的表现优于Melon,还有测试者认为Marshmallow的对话体验已经超过当前Opus 5。
不过,这一部分目前没有Anthropic官方Benchmark或系统卡支持。
更准确的理解方式,是把它视为早期测试者的主观反馈,不能直接等同于模型能力已经超过Opus 5。
Opus 5于7月24日正式发布,是目前Anthropic Opus产品线的最新版本。官方表示,Opus 5针对长时间运行的Agent进行了优化,同时提升了编程和专业工作能力,并在部分编码和知识工作评测中达到新的领先水平。
如果Marshmallow最终确实进入Opus或Sonnet产品线,那么它距离Opus 5发布只有一个月左右。
对于大模型来说,这种内部checkpoint快速迭代并不罕见。模型训练完成后,还需要经过指令微调、推理能力优化、安全评估、工具调用测试和部署验证,内部版本与最终公开版本之间可能存在较大差异。
所以,现在判断“Marshmallow已经超过Opus 5”还为时过早。
03 从动物到食物,Anthropic的命名方式变了?
这次曝光还有一个比较有意思的细节。
Marshmallow和Melon都属于食物名称。
Anthropic公开产品长期采用文学体裁命名,例如Haiku、Sonnet和Opus;Fable与Mythos也延续了这一体系。内部测试代号则并不一定遵循公开产品的命名规则。
此前曝光的部分Anthropic内部模型代号曾使用动物名称。
而这一次出现的Marshmallow和Melon明显属于另一套命名体系。
但仅凭两个名称,很难判断它们是否属于全新的模型架构或研发分支。
模型内部代号更多是研发管理工具,命名变化本身并不能证明底层技术路线发生变化。真正值得观察的还是模型最终对应的产品级能力,包括推理、编码、Agent执行、上下文处理以及成本效率。
如果未来Anthropic正式公布这两个模型,产品定位和技术规格才会给出更明确的答案。
04 Anthropic正在加快模型迭代?
从今年的产品发布节奏来看,Anthropic确实保持着较高的更新频率。
Claude Sonnet 5于6月30日发布,Opus 5于7月24日发布。
与此同时,Anthropic还持续更新Fable 5的能力。8月7日,公司就针对Fable 5的生物学安全机制进行了更新,在内部测试中将相关场景的误触发率降低约85%。
这说明,当前前沿模型的竞争已经越来越接近持续迭代的工程竞赛。
模型发布之后,厂商仍然需要继续优化推理效率、Agent能力、安全策略和工具使用能力。一个模型从内部checkpoint到正式产品,也可能经历多轮版本调整。
Marshmallow和Melon目前仍处于早期阶段,最终是否公开、采用什么名称、属于哪条产品线,都没有定论。
但它们出现在Anthropic API中,至少说明新的模型版本正在进行测试。
而在OpenAI、Google、xAI、DeepSeek等厂商持续推进模型更新的背景下,前沿模型的生命周期正在变短。
过去,一个旗舰模型可能需要等待较长时间才会迎来下一代产品。
现在,模型发布更像一场持续进行的迭代。
Marshmallow和Melon最终能走到哪一步还需要等待官方答案,但可以确定的是,Anthropic并没有停下模型迭代的脚步。
对于整个大模型行业来说,真正的竞争已经从一次次新品发布,逐渐变成了训练、推理、Agent、安全和成本效率之间的持续优化。
今天是Marshmallow和Melon,下一次又会是什么?




