
本文是圆方的第 1595 篇原创
(点击标题下方小耳机标志可收听音频)
01
许久未曾公开发言的张一鸣,最近就字节的大模型研发表态了。
张一鸣在字节 Seed 大模型团队内部会议就自研大模型定调:
他认为,训练大模型难度很高,团队无需过度焦虑,短期内可以接受模型落后行业,目标冲击全球第一梯队的智能上限。
他也认可编程是当下关键赛道,所以需整合火山引擎、飞书、豆包资源,夯实算力与数据优势。
同时也认为不能被热点裹挟,编程之外仍存在广阔机会。
也肯定Seedance(AI 生成视频)差异化的技术优势,鼓励走出自有技术路线,而非一味追随竞品。
张一鸣还谈到了自己对模型蒸馏的看法。
他反对蒸馏,认为蒸馏能在短期内改善模型表现,但本质上仍是在复制 Claude 已有的能力。
沿着这条路走,最多只能不断逼近对方,很难真正实现超越。他也希望 Seed 可以从更底层的维度去构建自己在 AGI 上的壁垒。
大家好,我是圆方,今天我们一起聊聊:
张一鸣 " 叫板 " 梁文峰?
02
印象中,张一鸣已经很久没有在媒体舆论场上出现发声了。
即便是有一些内部的讲话,在外部传播上也是控制得特别严。
这次关于大模型的表态,想来不是无心之失的流传出来,而是深思熟虑之后的一个发声考虑。。
在前不久,梁文峰 2026 年 7 月投资人闭门交流会速记被流传出来,对于大模型下一阶段的演化态势也做了一个研判
他认为,DeepSeek 长期愿景就是做成 AGI,产品只是通往 AGI 路上的副产物。
不能把精力分散到各类支线业务,所有决策优先考量 " 提升实现 AGI 的概率 ",流量、商业化、市值都排在后面。
明确当下重心重点攻坚 Coding Agent,它可以直接辅助模型研发,加速 AGI 推进;
视频、3D 生成等属于支线,暂时不投入主力资源。
还有说到,克制是一种战略,资源有限,每一次非主线扩张,都会降低抵达 AGI 的概率,主动放弃 C 端超级 App 路线,不为短期风口分散力量。
03
如果我们一条一条对应来看,可以看到张一鸣的表态几乎都回应了梁文峰提到的几个关键点。
围绕聚焦与多元,梁文峰的选择是极致的克制。他将几乎全部主力资源倾注于 Coding Agent,视频生成等方向被明确归为支线,暂不投入主力。
张一鸣的表态则呈现出一幅截然不同的图景。
他专门肯定 Seedance 的差异化优势,鼓励团队走出自己的技术路线,更强调编程之外仍有广阔机会。
这番定调等于是宣告,字节将同时押注编程、视频生成等多条战线,通过整合火山引擎、飞书、豆包所积蓄的算力与数据,寻求多维突破。
一方主张把力量集中到一个点上,一方选择多线并行,背后的判断差异极为鲜明。
04
关于技术路径的争论更具根本性。
张一鸣对蒸馏的反对语气格外坚决。
在他看来,蒸馏能在短期内改善模型表现,本质上仍是在复制 Claude 已有的能力,沿着这条路走,最多只能逼近对方,很难真正实现超越。
他要 Seed 团队从更底层的维度去构建 AGI 壁垒。
梁文峰虽未直接提及蒸馏,但 DeepSeek 长期以高效训练和开源为人所知,模型能力跃升迅速,外界难免会将其技术路线与各种提效方法联系起来。
张一鸣此刻高调亮出反对蒸馏的底牌,等于在基础方法论层面,与一种较为普遍的跟随做法划清了界限。
他传达的信息很清晰:
字节追求的是真正的原始创新,哪怕短期落后也绝不走复制捷径。
这构成了两个团队在技术信仰上的深度交锋。
05
再看模型进度的表态,同样耐人寻味。
DeepSeek 系列模型在多个评测中已展现出强劲实力,市场普遍认为其处于领先身位。
张一鸣却在内部坦然承认训练难度极高,短期内可以接受模型落后,目标直指全球第一梯队的智能上限。
这种公开接受落后的姿态,配上一个无比宏大的终极目标,表达的是一套全然不同的竞赛逻辑。
C 端应用的路线分歧同样无法忽视。
梁文峰明确提出放弃 C 端超级 App,他认为流量和商业化会降低实现 AGI 的概率。
张一鸣的整合策略则走向相反方向。豆包作为 C 端超级应用被纳入大模型战略的核心资源圈,其算力与大规模用户数据积累将直接反哺模型训练。
这是把 AGI 探索与用户生态深度耦合的思路。
一个向内极致收敛,一个向外持续延展,从理念到落地方案都针锋相对。
06
这是极其罕见的中国两位科技创新型企业家,在同一赛道上公开亮出 " 不完全一样 " 的路线图。
而这件事的意义,可能远远超出个人风格之争。它意味出中国 AI 在迈向 AGI 的关键阶段,出现了真正意义上的路径分化。
圆方觉得,这是一件好事。
过去,中国在创新的路上往往都是跟随和模仿,所以步调很多时候都是一致的,不管是当年的百团大战,还是后面的千模大战,都是这样。
而今天,不再所有人都顺着同一种共识前行,最顶尖的头脑开始就核心命题进行公开辩论。这种竞争和争论的空间,不管是对行业,甚至对社会都极为宝贵。
当梁文峰用克制来集中力量,张一鸣用整合来拓展边界,两种模式都会在现实中得到反复检验。
无论最后谁更逼近 AGI,过程中沉淀下来的工程能力、人才密度和原创技术,都将成为中国 AI 的集体财富。
叫板也罢,对垒也好,这种富有张力的竞合,恰恰是创新最需要的氛围。
中国 AI 需要这样的多元探索,也需要这样敢于为各自信仰全力下注的勇气。
07
张一鸣这番讲话流出的同时,据媒体报道,字节跳动内部正在讨论训练一个 参数规模超 5 万亿的 模型,它超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),也是目前国内已知参数规模最大的模型。
而根据统计,7 月 27 ‑ 8 月 2 日,算力聚合平台周度 Token 调用榜单,DeepSeek ‑ V4 ‑ Flash 以 7.22 万亿 Token 登顶单模型第一,环比上涨 13%;
DeepSeek 厂商整体也拿到厂商榜第一。
也就是今天,DeepSeek 在开放平台发布预告:
计划近期整体上调 API 服务价格,提示预计涨幅较大,具体调价幅度、生效时间以待正式通知 。
所以小伙伴们,你们更看好在未来的一年中,谁能够做出更加厉害的国产基础模型呢?


登录后才可以发布评论哦
打开小程序可以发布评论哦