新芒xAI 8月6日消息,张一鸣据称近日在字节跳动Seed团队内部会议上表态,做模型要坚持长期主义和延迟满足,不应依赖别人的模型输出换取短期榜单排名。相关报道还称,字节内部对开源模型蒸馏采取严格限制,甚至通过API检测等方式加强约束,张一鸣认为蒸馏会干扰真正意义上的长期技术突破。
关键要点
- 这条消息来自内部人士口径和媒体报道,字节跳动尚未就张一鸣具体发言发布公开公告,因此相关表述应按“据称”“报道称”处理。
- Seed是字节跳动基础模型研发的核心团队,近年承担豆包、Seedance、多模态、Agent和底层模型能力建设等关键任务。
- “拒绝蒸馏”的含义并不是否定模型蒸馏作为机器学习技术本身,而是反对依靠未经授权或过度依赖外部模型输出,快速换取评测表现和短期排名。
- 在国内开源模型快速迭代、榜单竞争加剧的背景下,字节若坚持更重的自主训练路线,短期可能牺牲部分速度,但有利于建立长期可解释、可控和可持续的模型能力。
新芒xAI评论
张一鸣这次表态之所以值得关注,是因为它击中了中国大模型竞争的一个现实矛盾:榜单排名很快能带来声量,但真正的模型能力很难靠短期模仿建立。蒸馏可以降低成本、加速追赶,也可以用于模型压缩和部署优化;但如果团队把它当成绕过底层研发的捷径,长期能力上限就会被教师模型和数据来源锁住。
对字节来说,拒绝以外部输出换排名,也是一种组织纪律。Seed团队背靠豆包、火山引擎、抖音、剪映、飞书等高频场景,真正需要的是能持续服务海量用户和复杂业务的基础模型,而不是只在公开评测中短暂领先。长期主义在这里不是口号,而是意味着更高训练成本、更慢反馈周期和更难的人才管理。
但这条路线也会带来压力。国内开源模型正在快速推进,DeepSeek、阿里、腾讯、智谱等玩家都在压低模型使用门槛。字节如果选择更克制的自主研发路线,就必须用更强的产品落地和模型迭代证明投入值得。下一阶段竞争不会只看谁拒绝蒸馏,而会看谁能在合规、自主、成本和效果之间真正跑通闭环。