博客/语音智能

2026.08.05
SeedRealtime 音视频全双工大模型发布:走向全模态自然交互作为原生音视频全双工大模型,联合理解声音、画面与时序信息,带来边看、边听、边说的自然交互体验
2026.07.20
从“会说”走向“会创作”| Seed Audio 1.0 音频创作模型发布统一框架下联合建模人声、音效和环境声等音频要素
2026.04.09
Seed 全双工语音大模型发布:懂倾听、抗干扰,走向更自然的交互作为原生全双工语音大模型,实现精准抗干扰与动态判停,交互更自然
2025.07.24
Seed 端到端同声传译大模型发布:准确率接近真人,3s 延迟,实时声音复刻中英同传翻译质量达到业界 SOTA,同时实现了极低的语音延迟水平
2025.01.20
豆包实时语音大模型上线即开放!情商智商双高使用原生方法深度融合语音与文本模态,实现真正意义上的端到端语音对话模型