潮新闻客户端 记者 甘居鹏
2026 年夏天的 AI 大模型赛道,只有一种节奏:快。
7 月至 8 月,阿里通义千问 Qwen3.8-Max、月之暗面 Kimi K3、DeepSeek-V4-Flash、智谱 GLM-5.2、字节 Seedance 2.5 五款重量级模型接连亮相。
国内厂商在两个多月里接连落子,进入了全球前沿梯队,这宣告大模型竞争正式进入了高频迭代时代。
同时,斯坦福《2026 人工智能指数报告》指出,中美顶尖模型的综合性能差距已大幅收窄,中国开放权重模型在全球开发者中的接受度持续走高。
尽管新发布了 Seedance 2.5,但字节跳动创始人张一鸣在 7 月的内部会议上强调,字节 Seed 的 AI 研发将坚持长期主义、走自主路线,不依赖外部模型输出提升自身能力。

张一鸣。资料图
张一鸣表示,做模型应当愿意为更长远的技术目标牺牲部分短期收益,而非追求一时的榜单排名。
字节跳动内部人士透露,公司负责大模型研发的 Seed 团队在 AI 研发中始终强调自主攻关,通过加强内部规范确保技术路线的独立性和可持续性。
另据媒体报道,字节跳动内部对开源模型严禁蒸馏,甚至通过 API 检测等方式在内部加强相关限制。张一鸣认为,蒸馏会干扰真正意义上的长期技术突破。
" 蒸馏 " 本是人工智能领域的一项基础技术。2015 年,被誉为 " 深度学习之父 " 的杰弗里 · 辛顿等人明确提出这一技术命名,其核心逻辑是:让算力充沛的大模型做 " 师傅 ",轻量级的小模型做 " 徒弟 ",后者通过观察前者的输入输出,学习其解决问题的思路和方法,最终实现能力复刻。
简单来说,就是 " 抄作业 "。它能让追赶者在榜单上快速交出漂亮答卷,是当下许多 AI 公司追赶头部梯队的高效路径。

图据视觉中国
行业路径分野已经清晰。一边是 " 快 ",高频发布、榜单冲刺、开源生态、成本碾压;另一边是 " 慢 ",闭源自研、拒绝蒸馏、押注长期。
张一鸣选择了后者。字节跳动正在用当下的 " 慢 ",换取未来某个节点上真正的 " 快 "。
早在 2023 年,字节跳动就明确了对蒸馏的反对态度,当时大模型团队还处于早期探索阶段。2023 年 4 月,字节引入 GPT API 调用规范检查后,模型团队内部随即提出明确要求:不得将 GPT 生成的数据加入字节模型的训练数据集。
但这项内部规定并没有终结争论。此后,部分研究人员仍会提出蒸馏方案。直到这一次,他们等到了张一鸣的直接表态。
张一鸣给字节 AI 战略踩下了一脚与众不同的刹车,给出了 " 慢下来 " 的定调。
慢下来的代价,已经在榜单上清晰显现。最新一期 Artificial Analysis 排行榜中,Seed 排名远低于 Kimi K3、DeepSeek-V4-Flash、Qwen3.7-Max 等其他模型。

8 月 6 日,字节跳动 CEO 梁汝波在公司全员会上承认,Seed 的大语言模型与海外领先模型之间的差距正在扩大。他要求团队接受一段时间的落后,坚持自研和长期优化。
但字节并非全盘皆输。在多模态文生视频领域,字节的 Seedance 2.0/2.5 仍处于领先的位置。更关键的是,字节跳动是国内主要 AI 公司中唯一一家大语言模型几乎全为专有模型的企业。当同行们拥抱开源、社区共创、快速迭代时,字节选择了最孤独也最艰难的路,完全闭源自研。
慢,是为了蓄力一跃。
据报道,字节正在讨论训练一个参数规模超过 5 万亿的大模型,用巨大的算力、数据和组织资源优势,试图通过一次跃迁实现弯道超车。
张一鸣也将更多的时间投入到 Seed 团队。字节正押注大模型这场长跑,但拒绝用短跑的方式参赛。
" 延迟满足感 " 这句话,张一鸣说了十年。

2016 年接受媒体专访时,这被他列为自己特质之首。今日头条不赚快钱、把利润投进推荐算法,抖音在海外做 TikTok,回头再看,都是同一套逻辑在不同战场的延续。
看似放弃了眼前确定的小收益,实则换一个长期更大的可能性。这或许是对狂奔时代最清醒的提醒。
" 转载请注明出处 "


登录后才可以发布评论哦
打开小程序可以发布评论哦