RecodeX 重构消息,字节跳动Seed团队发布原生视听全双工大模型SeedRealtime。该模型在统一架构中融合音频、视频和文本,能够基于连续多模态流进行实时交互,而非逐轮对话。Seed表示,模型在联合视听理解等方面实现突破,是迈向全模态交互的重要一步。