字节跳动发布音视频全双工大模型 SeedRealtime
2026-08-05·大模型
字节发布 SeedRealtime 大模型,实现边看边听边说实时交互。
8月5日,字节跳动发布音视频全双工大模型 SeedRealtime,可实现边看、边听、边说的实时多模态交互。该模型打通语音与视觉的双向实时理解与生成,面向智能助手、实时翻译等场景。此举是字节在 Seed 系列模型上的又一步扩张,也进一步加剧了多模态实时交互领域的竞争。
字节发布 SeedRealtime 大模型,实现边看边听边说实时交互。
8月5日,字节跳动发布音视频全双工大模型 SeedRealtime,可实现边看、边听、边说的实时多模态交互。该模型打通语音与视觉的双向实时理解与生成,面向智能助手、实时翻译等场景。此举是字节在 Seed 系列模型上的又一步扩张,也进一步加剧了多模态实时交互领域的竞争。