2026年08月08日 星期六
目录

字节跳动 AI 新战略疑似曝光:5 万亿参数大模型正在酝酿?

人工智能AI2026-08-07
《晚点 LatePost》的一则独家报道把字节跳动推上了风口浪尖:这家互联网巨头正在内部探讨训练一款参数量突破 5 万亿的新模型。横向对比就能体会这个数字的分量——阿里 Qwen 3.8-Max 为 2.4 万亿参数,月之暗面 Kimi K3 为 2.8 万亿参数,一旦项目落地,它将成为目前国内已知参数规模最大的模型。据了解,该项目计划由 Seed Fo...

  《晚点 LatePost》的一则独家报道把字节跳动推上了风口浪尖:这家互联网巨头正在内部探讨训练一款参数量突破 5 万亿的新模型。横向对比就能体会这个数字的分量——阿里 Qwen 3.8-Max 为 2.4 万亿参数,月之暗面 Kimi K3 为 2.8 万亿参数,一旦项目落地,它将成为目前国内已知参数规模最大的模型。据了解,该项目计划由 Seed Foundation 负责人项亮牵头,与预训练数据负责人沈科搭档推进。不过需要泼一盆冷水的是,眼下一切还停留在早期讨论阶段,最终能否问世尚无定论。

1.jpg

真正耐人寻味的,是张一鸣最近在 Seed 全员会上的三次表态。

  第一个信号是"允许落后"。张一鸣认为训练大模型本身就是一件极难的事,团队无需因为暂时的落后而焦虑,Seed 应该继续瞄准智能上限,力争跻身全球第一梯队。第二个信号是"反对蒸馏"。在他看来,蒸馏虽然能快速拉高模型表现,但本质上不过是复制 Claude 已有的能力,沿着这条路走最多只能无限逼近对方,几乎不可能实现真正的超越——所以哪怕意味着短期内被国内对手甩开,Seed 也不会走这条捷径。第三个信号则是"别被 Coding 带偏"。他认可 Coding 是当前最重要的方向之一,字节也确实投入巨大:火山引擎、飞书、豆包等业务的资源和数据已经整合打通,还以高薪请来 DeepSeek 核心研究员郭达雅负责 Coding 专项训练。但他同时提醒团队,编程只是眼下的热点,编程之外还藏着更多、更大的机会。

  这些表态并非空穴来风,其背后是 Seed 过去半年的强烈反差。一方面,Seedance 和 Seedream 在视频、图像生成领域迅速杀到行业领先位置,Seedance 甚至已成为火山引擎 MaaS 收入的基本盘;另一方面,语言模型 Seed 2.0 市场反响有限,Coding 能力又落后于 Anthropic、智谱和月之暗面,火山引擎的 Token 增长同样没能达到原定目标。喜忧参半的成绩单,逼着字节必须做出选择。

  而字节最终选择的,是一条最符合自己性格的路线:收拢资源、取消内部赛马、扩大预训练规模、训练更大的模型,直接把参数量一次推到同行的数倍。这套打法并非没有先例——Seedance 已经证明过,只要模型能力做到行业第一,用户和收入就会迅速涌入。如今字节想把同一套方法论复制到语言模型上,只不过这一次面对的,是一个 5 万亿参数级别的庞大系统工程。

一位接近 Seed 的人士将之形容为"一场赌博"。

更确切地说,这是张一鸣对下一代模型能力的一场豪赌:

宁愿暂时落后,也不跟在 Claude 身后抄答案。

扫描二维码手机访问

文章目录