DoNews 3小时前
字节Seed重组为四大一级部门,推进5万亿参数模型研发
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

8 月 20 日,字节跳动 Seed 部门完成新一轮组织调整,成立四个新的一级部门:Pretrain Data、Horizon RL、Product Posttrain-Work 及 Product Posttrain-Chat,旨在合并相似职能、减少重复投入。

Pretrain Data 由李成刚负责,整合原分散于文本模型、编程、视觉理解与语音方向的预训练数据团队,统一承担新 Omni 模型的多模态数据建设及超大模型预训练所需的数据工作。

Horizon RL 由唐晟宇负责,整合此前分散在后训练、推理和视觉理解领域的后训练团队,专注强化学习技术,以提升模型基础智能上限。

Product Posttrain-Work 由秦禹嘉负责,面向 B 端应用,承担 Agentic 模型的整合与发布,并针对办公场景优化 Agentic 能力,支持豆包和 Dola 的任务模式。

原 Application 团队由朱文佳负责,现更名为 Product Posttrain-Chat,继续服务 C 端应用,负责对话模型的整合与发布,与 Product Posttrain-Work 分工协作。

四个新部门负责人均向 Seed 负责人吴永辉汇报。此外,Seed 还为 AI 安全及其他前沿探索方向分别任命了负责人。

在 7 月 Seed 全员会上,字节跳动创始人张一鸣表示将持续加大 AI 投入,可接受模型短期落后于行业,强调以追求智能上限为目标,期望 Seed 模型能力跻身世界第一梯队。

张一鸣明确反对模型蒸馏技术,指出其仅能复制已有能力,难以实现真正超越;主张从底层构建 AGI 技术壁垒,即便短期技术进度落后于国内同行亦不采用该路径。

当前,Seed 正推进训练参数规模超 5 万亿的模型,为国内已知最大规模语言模型,由 Seed Foundation 负责人项亮主导,联合大语言模型预训练数据负责人沈科共同推进。此次组织调整系为适配该模型研发而重新梳理职责、分配资源。

此举部分源于 Seed 2.0 今年发布后市场反响有限,团队判断与其在现有参数规模上持续追赶,不如一次性将参数推至同行数倍,争取领先位置。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

张一鸣 字节跳动 文佳 创始人 编程
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论