欢迎您访问欢迎来到沄森网,沄森智能旗下资讯平台!今天是:2026年08月05日 星期三 农历:丙午(马)年-六月-廿三
您现在的位置是:首页 > 热点

字节跳动推出音视频全双工大模型 SeedRealtime提升对话流畅度

创始人2026-08-05 19:06:13
字节跳动在2026年8月5日正式发布了原生音视频全双工大模型SeedRealtime。该模型采用统一架构,将音频、视频与文本原生融合,能够在连续多模态信息流上进行实时交互

字节跳动在2026年8月5日正式发布了原生音视频全双工大模型SeedRealtime。该模型采用统一架构,将音频、视频与文本原生融合,能够在连续多模态信息流上进行实时交互。

端到端人工评测显示,与级联模型相比,SeedRealtime的音视频对话节奏问题减少了一半。模型在把握说话时机方面更为自然,减少了话未说完被抢断、话音已落却回应迟缓、被背景杂音与闲聊误触发等情况。此外,单次对话完整顺畅交流的概率也显著提升。

目前,SeedRealtime已在豆包App全面上线。

所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。

举报邮箱:1002263188@qq.com