AI 【新芒xAI】张一鸣据称要求Seed拒绝蒸馏,字节大模型转向长期主义

【新芒xAI】张一鸣据称要求Seed拒绝蒸馏,字节大模型转向长期主义

新芒xAI 8月6日消息,张一鸣据称近日在字节跳动Seed团队内部会议上表态,做模型要坚持长期主义和延迟满足,不应依赖别人的模型输出换取短期榜单排名。相关报道还称,字节内部对开源模型蒸馏采取严格限制,甚至通过API检测等方式加强约束,张一鸣认为蒸馏会干扰真正意义上的长期技术突破。

关键要点

  • 这条消息来自内部人士口径和媒体报道,字节跳动尚未就张一鸣具体发言发布公开公告,因此相关表述应按“据称”“报道称”处理。
  • Seed是字节跳动基础模型研发的核心团队,近年承担豆包、Seedance、多模态、Agent和底层模型能力建设等关键任务。
  • “拒绝蒸馏”的含义并不是否定模型蒸馏作为机器学习技术本身,而是反对依靠未经授权或过度依赖外部模型输出,快速换取评测表现和短期排名。
  • 在国内开源模型快速迭代、榜单竞争加剧的背景下,字节若坚持更重的自主训练路线,短期可能牺牲部分速度,但有利于建立长期可解释、可控和可持续的模型能力。

新芒xAI评论

张一鸣这次表态之所以值得关注,是因为它击中了中国大模型竞争的一个现实矛盾:榜单排名很快能带来声量,但真正的模型能力很难靠短期模仿建立。蒸馏可以降低成本、加速追赶,也可以用于模型压缩和部署优化;但如果团队把它当成绕过底层研发的捷径,长期能力上限就会被教师模型和数据来源锁住。

对字节来说,拒绝以外部输出换排名,也是一种组织纪律。Seed团队背靠豆包、火山引擎、抖音、剪映、飞书等高频场景,真正需要的是能持续服务海量用户和复杂业务的基础模型,而不是只在公开评测中短暂领先。长期主义在这里不是口号,而是意味着更高训练成本、更慢反馈周期和更难的人才管理。

但这条路线也会带来压力。国内开源模型正在快速推进,DeepSeek、阿里、腾讯、智谱等玩家都在压低模型使用门槛。字节如果选择更克制的自主研发路线,就必须用更强的产品落地和模型迭代证明投入值得。下一阶段竞争不会只看谁拒绝蒸馏,而会看谁能在合规、自主、成本和效果之间真正跑通闭环。

文章来源信息声明: 本文信息出自权威媒体、企业官方及网络,并经新芒X编辑,转载请注明源出处、作者和链接。 图片部分来源于网络,在此表示感谢,如有侵权请联系我方处理。 文章发布日期后方火形图标后的数字,为文章热度,谨代表受欢迎程度。 新芒X平台仅对用户提供信息及决策参考,本文不构成投资建议。

作者: 新芒Group

新芒出品,专注专业。兼具内容品质和传播影响力
关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部