字节跳动于 2026 年 8 月 5 日正式推出原生音视频全双工大模型 SeedRealtime。该模型采用统一架构,原生融合音频、视频与文本,能够在连续多模态信息流上进行实时交互。
端到端人工评测结果显示,与级联模型相比,SeedRealtime 的音视频对话节奏问题减少一半,模型在说话时机的把握上更为自然," 话未说完被抢断、话音已落却回应迟缓、被背景杂音与闲聊误触发 " 等情况显著减少;同时,单次对话完整、顺畅交流的概率也有明显提升。
SeedRealtime 已在豆包 App 全量上线。
市场有风险,投资需谨慎。本文为 AI 基于第三方数据生成,仅供参考,不构成个人投资建议。
本文源自:市场资讯
疑似使用 AI 生成,请谨慎甄别


登录后才可以发布评论哦
打开小程序可以发布评论哦