星河商业观察 6小时前
张一鸣罕见发声:字节不抄AI近道
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

一向低调的字节跳动创始人张一鸣,却在国产大模型加速迭代之际罕见发声。

8 月 6 日,据报道张一鸣在上个月举行的 Seed 团队全员大会中明确表态:做模型要坚持长期主义、延迟满足,而不是用别人的输出,换一时的榜单排名," 应该愿意为长期目标牺牲一部分短期收益 "。

张一鸣虽然把一半的工作时间和精力都放在 Seed 业务上,却很少在 Seed 团队会议上发言,也很少发表公开的思考和言论。每当有一个能力较强的开源模型发布,Seed 团队关于 " 是否该用蒸馏快速追赶 " 的讨论争论就会重新升温。

此次罕见定调,直接回应了字节内部持续升温的这场争论。

所谓模型蒸馏,是指利用更强模型的输出训练另一个模型。它可以显著降低训练成本、缩短开发周期,是行业内普遍使用的提速手段。

这在全球 AI 行业早已是成熟的通行做法。谷歌用旗舰模型 Gemini Pro 蒸馏出开源的 Gemma 3 系列,参数量仅为前者的几十分之一,却能复现大部分通用能力;微软的 Phi、Orca 系列小模型,核心训练数据就来自 GPT-4 的合成输出,用极低的算力成本做到了逼近大模型的效果。Meta 的 Llama 系列迭代中,也大量采用自蒸馏技术,用大版本模型反哺小参数版本的能力。

耐人寻味的是,海外头部大厂一面把蒸馏当作内部降本提效的常规手段,一面又在严防竞品 " 抄近道 "。今年以来,OpenAI、Anthropic、谷歌三家已通过前沿模型论坛共享情报,联合打击未经授权的第三方蒸馏行为。

但字节的选择是拒绝。

据了解,字节跳动内部严禁蒸馏开源模型,Seed 团队内部已通过 API 异常检测、增强开源模型数据过滤等工程手段,防止研发人员私下调用第三方模型输出作为训练集。

拒绝捷径是有现实代价的。

旗舰模型 Seed 2.1 Pro 目前没有被收录进最受关注的模型排行榜 Artificial Analysis。字节是国内头部 AI 厂商中对开源路线相对克制、核心旗舰模型均保持闭源的企业之一。榜单排名的差距,很可能直接影响行业声量与 B 端客户的选型优先级。

不过,在视频生成赛道上,字节领先全球。今年 2 月推出 Seedance 2.0,7 月 31 日又发布 Seedance 2.5,将单次视频生成时长从 15 秒提升至 30 秒。8 月 5 日,字节发布原生音视频全双工大模型 SeedRealtime,已在豆包 App 全量上线,实现 " 边看、边听、边说 " 的实时交互,端到端评测显示,其对话节奏问题(如延迟、抢话等)的发生率较传统级联系统降低约一半。

截至今年 6 月,豆包月活跃用户规模达 3.82 亿,大模型日均 Token 调用量达 180 万亿。字节还计划将 2026 年 AI 基础设施资本支出预算上调约 25%,至 2000 亿元,其中约 850 亿元用于 AI 芯片采购。

短期榜单会随评测标准更新而快速失效,只有掌握完整独立的技术链条,才有持续调整和进化的底气。字节这次的选择,代价是眼前的排名,赌注,押在未来的底座上。

这场 " 慢 " 与 " 快 " 的对决,接下来几个季度会陆续给出答案。

来源:星河商业观察

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

张一鸣 开源 ai 字节跳动 谷歌
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论