圆方你怎么看啊 12小时前
张一鸣“叫板”梁文峰?
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

本文是圆方的第 1595 篇原创

(点击标题下方小耳机标志可收听音频)

01

许久未曾公开发言的张一鸣,最近就字节的大模型研发表态了。

张一鸣在字节 Seed 大模型团队内部会议就自研大模型定调:

他认为,训练大模型难度很高,团队无需过度焦虑,短期内可以接受模型落后行业,目标冲击全球第一梯队的智能上限。

他也认可编程是当下关键赛道,所以需整合火山引擎、飞书、豆包资源,夯实算力与数据优势。

同时也认为不能被热点裹挟,编程之外仍存在广阔机会。

也肯定Seedance(AI 生成视频)差异化的技术优势,鼓励走出自有技术路线,而非一味追随竞品。

张一鸣还谈到了自己对模型蒸馏的看法。

他反对蒸馏,认为蒸馏能在短期内改善模型表现,但本质上仍是在复制 Claude 已有的能力。

沿着这条路走,最多只能不断逼近对方,很难真正实现超越。他也希望 Seed 可以从更底层的维度去构建自己在 AGI 上的壁垒。

大家好,我是圆方,今天我们一起聊聊:

张一鸣 " 叫板 " 梁文峰?

02

印象中,张一鸣已经很久没有在媒体舆论场上出现发声了。

即便是有一些内部的讲话,在外部传播上也是控制得特别严。

这次关于大模型的表态,想来不是无心之失的流传出来,而是深思熟虑之后的一个发声考虑。。

在前不久,梁文峰 2026 年 7 月投资人闭门交流会速记被流传出来,对于大模型下一阶段的演化态势也做了一个研判

他认为,DeepSeek 长期愿景就是做成 AGI,产品只是通往 AGI 路上的副产物。

不能把精力分散到各类支线业务,所有决策优先考量 " 提升实现 AGI 的概率 ",流量、商业化、市值都排在后面。

明确当下重心重点攻坚 Coding Agent,它可以直接辅助模型研发,加速 AGI 推进;

视频、3D 生成等属于支线,暂时不投入主力资源。

还有说到,克制是一种战略,资源有限,每一次非主线扩张,都会降低抵达 AGI 的概率,主动放弃 C 端超级 App 路线,不为短期风口分散力量。

03

如果我们一条一条对应来看,可以看到张一鸣的表态几乎都回应了梁文峰提到的几个关键点。

围绕聚焦与多元,梁文峰的选择是极致的克制。他将几乎全部主力资源倾注于 Coding Agent,视频生成等方向被明确归为支线,暂不投入主力。

张一鸣的表态则呈现出一幅截然不同的图景。

他专门肯定 Seedance 的差异化优势,鼓励团队走出自己的技术路线,更强调编程之外仍有广阔机会。

这番定调等于是宣告,字节将同时押注编程、视频生成等多条战线,通过整合火山引擎、飞书、豆包所积蓄的算力与数据,寻求多维突破。

一方主张把力量集中到一个点上,一方选择多线并行,背后的判断差异极为鲜明。

04

关于技术路径的争论更具根本性。

张一鸣对蒸馏的反对语气格外坚决。

在他看来,蒸馏能在短期内改善模型表现,本质上仍是在复制 Claude 已有的能力,沿着这条路走,最多只能逼近对方,很难真正实现超越。

他要 Seed 团队从更底层的维度去构建 AGI 壁垒。

梁文峰虽未直接提及蒸馏,但 DeepSeek 长期以高效训练和开源为人所知,模型能力跃升迅速,外界难免会将其技术路线与各种提效方法联系起来。

张一鸣此刻高调亮出反对蒸馏的底牌,等于在基础方法论层面,与一种较为普遍的跟随做法划清了界限。

他传达的信息很清晰:

字节追求的是真正的原始创新,哪怕短期落后也绝不走复制捷径。

这构成了两个团队在技术信仰上的深度交锋。

05

再看模型进度的表态,同样耐人寻味。

DeepSeek 系列模型在多个评测中已展现出强劲实力,市场普遍认为其处于领先身位。

张一鸣却在内部坦然承认训练难度极高,短期内可以接受模型落后,目标直指全球第一梯队的智能上限。

这种公开接受落后的姿态,配上一个无比宏大的终极目标,表达的是一套全然不同的竞赛逻辑。

C 端应用的路线分歧同样无法忽视。

梁文峰明确提出放弃 C 端超级 App,他认为流量和商业化会降低实现 AGI 的概率。

张一鸣的整合策略则走向相反方向。豆包作为 C 端超级应用被纳入大模型战略的核心资源圈,其算力与大规模用户数据积累将直接反哺模型训练。

这是把 AGI 探索与用户生态深度耦合的思路。

一个向内极致收敛,一个向外持续延展,从理念到落地方案都针锋相对。

06

这是极其罕见的中国两位科技创新型企业家,在同一赛道上公开亮出 " 不完全一样 " 的路线图。

而这件事的意义,可能远远超出个人风格之争。它意味出中国 AI 在迈向 AGI 的关键阶段,出现了真正意义上的路径分化。

圆方觉得,这是一件好事。

过去,中国在创新的路上往往都是跟随和模仿,所以步调很多时候都是一致的,不管是当年的百团大战,还是后面的千模大战,都是这样。

而今天,不再所有人都顺着同一种共识前行,最顶尖的头脑开始就核心命题进行公开辩论。这种竞争和争论的空间,不管是对行业,甚至对社会都极为宝贵。

当梁文峰用克制来集中力量,张一鸣用整合来拓展边界,两种模式都会在现实中得到反复检验。

无论最后谁更逼近 AGI,过程中沉淀下来的工程能力、人才密度和原创技术,都将成为中国 AI 的集体财富。

叫板也罢,对垒也好,这种富有张力的竞合,恰恰是创新最需要的氛围。

中国 AI 需要这样的多元探索,也需要这样敢于为各自信仰全力下注的勇气。

07

张一鸣这番讲话流出的同时,据媒体报道,字节跳动内部正在讨论训练一个 参数规模超 5 万亿的 模型,它超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),也是目前国内已知参数规模最大的模型。

而根据统计,7 月 27 ‑ 8 月 2 日,算力聚合平台周度 Token 调用榜单,DeepSeek ‑ V4 ‑ Flash 以 7.22 万亿 Token 登顶单模型第一,环比上涨 13%;

DeepSeek 厂商整体也拿到厂商榜第一。

也就是今天,DeepSeek 在开放平台发布预告:

计划近期整体上调 API 服务价格,提示预计涨幅较大,具体调价幅度、生效时间以待正式通知 。

所以小伙伴们,你们更看好在未来的一年中,谁能够做出更加厉害的国产基础模型呢?

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

张一鸣 编程 ai 投资人
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论