新闻

揭秘字节 Seedance:中国第一台大模型印钞机启动了 | 深氪

1 分钟阅读
来源:36氪
采访 | 邓咏仪 肖思佳 李小霞 文 | 张雨忻 邓咏仪 编辑 | 张雨忻 杨轩 2025 年底,在一次模型团队的聚餐上,Seedance 模型的负责人曾妍向 leader 提到,她还是想试试训一个更大尺寸的模型,至少达到 200B(2000亿参数)。 曾妍是字节 Seed 一位非常年轻的研究员,2021 年校招生,研究方向始终聚焦在视频理解与生成上。“她一直都挺有自己的技术判断。” 一位与曾妍打过交道的人告诉 36 氪,“而且很主动,对于相信的事情比较坚持,会想办法争取资源去实现。” 这个评价几乎复现了曾妍做 Seedance2.0 训练时的处境。“她想训一个参数量更大的模型,但当时团队内部有一些分歧,有人觉得把模型直接 scale up 到 200B-300B 的级别有点冒进了,并且整体的训练资源也紧张,可能先训一个 100B 级别的模型技更安全。”一位知情人士告诉 36 氪。 上述人士说,但恰巧有高管参与上述聚餐,了解到曾妍的想法后,说可以给 Seedance2.0 的训练协调一些资源,“后来在 Seed 内部最终的正式评审会上,Seed 负责人吴永辉和视觉多模态生成方向负责人周畅讨论后,,最终也选择了支持曾妍的想法。” 这个在当时看起来有些激进的技术选择,最终被证明是正确的。“因为曾妍坚持模型要足够大,训练数据要足够丰富,Seedance 2.0 才成了。”上述知情人士说。 我们采访了多位字节内外的 AI 从业者,大部分人都认为, 字节在大模型上真正的口碑逆转,就是从 Seedance 2.0 开始的 : 在大语言模型上,豆包大模型直到 2025 年年中迭代到 1.6,