人工智能 来源:MarkTechPost 整理:feaOS 2026-08-18 20:39:40

Cartesia发布Sonic-3.6:全新实时语音合成模型

近日,Cartesia发布了其最新的实时文本转语音(TTS)模型Sonic-3.6。该版本在自然度方面进行了改进,并且已经在Artificial Analysis的两个语音合成排行榜上占据首位,分别以1283和1123的Elo分值领先于其他竞争对手。Sonic-3.6采用状态空间模型而非传统的转换器架构,在90毫秒内生成首段音频,适用于金融、医疗保健等多个行业的多种应用场景。该模型已进入Beta阶段,并作为托管API提供,支持包括呼叫中心在内的多个行业应用,如客户支持代理、预约提醒和销售培训模拟等。

ENTRY_ID: NEWS-13377 READ_MODE: SHORT_SIGNAL