IT之家 8 月 5 日消息,字节跳动 Seed 今日宣布推出 原生音视频全双工大模型 SeedRealtime , 走向全模态自然交互。 SeedRealtime 用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。它实现了以下三项核心突破: • 音视频联合理解: 原生支持声音、画面与时序信息的深度融合。模型既能结合场景消解同音词歧义,...