财联社-深度 5小时前
字节跳动发布音视频全双工大模型SeedRealtime
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

【字节跳动发布音视频全双工大模型 SeedRealtime】财联社 8 月 5 日电,字节跳动正式推出原生音视频全双工大模型 SeedRealtime。SeedRealtime 用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来 " 边看、边听、边说 " 的全新体验。端到端人工评测结果显示,相比级联模型,SeedRealtime 的音视频对话节奏问题减少了一半——模型对说话时机的把握更加自然," 话未说完被抢断、话音已落却回应迟缓、或是被背景杂音与闲聊误触发 " 等卡壳现象显著减少;同时,单次对话能够完整、顺畅交流的概率也有明显提升。目前,SeedRealtime 已在豆包 App 全量上线。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

抢断 字节跳动 财联社
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论