全部标签

#音视频多模态

1 篇文章

·技术
1 分钟0

SeedRealtime 深度调研:字节原生音视频全双工大模型,与 GPT-Live / Gemini Live 的三条路线之争

> 2026 年 8 月 5 日,字节跳动 Seed 团队发布原生音视频全双工大模型 SeedRealtime,并在豆包 App 全量上线——官方称这是"业界音视频全双工技术的首次规模化落地"。它的定位不是"会说话的 Chatbot",而是"边看、边听、边说":模型持续看着摄像头画面、听着环