 
                            文章来源:智汇AI 发布时间:2025-10-31
Sonic-3是Cartesia最新发布的语音AI引擎,是当前市场上速度最快、最自然的实时语音对话模型。采用创新的“状态空间模型”(SSM)架构,非传统的Tra
暂无访问Sonic-3是Cartesia最新发布的语音AI引擎,是当前市场上速度最快、最自然的实时语音对话模型。采用创新的“状态空间模型”(SSM)架构,非传统的Transformer模型,能更有效地模拟人类思维,记住对话主题和情绪,无需每次都从头分析上下文。使得Sonic-3的延迟低于100毫秒,在实时语音交互行业中处于领先地位。Sonic-3支持42种语言,覆盖全球95%的人口,包括9种印度语言,能为不同市场的需求提供母语级的语音模型。具备智能上下文理解能力,能自动识别并正确朗读如NASA、FBI等缩写和首字母缩写词,显著增强了对话的流畅性。引擎支持语音克隆功能,用户可在短短10秒内生成个性化语音,企业版还提供专业的语音调优与品牌音色定制服务。
