字节跳动

8月6日,字节跳动Seed宣布推出原生音视频全双工大模型SeedRealtime。这款模型的核心突破在于——它不再只是“看”或“听”,而是同时“看、听、说”。SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。这意味着AI可以同时处理你说话的声音、你展示的画面,以及你输入的文字,在同一个对话流里完成多模态理解与回应。想象

A5创业网 版权所有