字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现"边看、边听、边说"的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地。
模型
·字节 Seed:Research Feed(网页内嵌数据)
字节 Seed 发布 SeedRealtime 音视频全双工大模型,走向全模态自然交互
— SeedRealtime 音视频全双工大模型发布:走向全模态自然交互