观点 / 方法精选
MiniMax发布新一代语音模型Speech 2.6
原始标题:MiniMax Speech 2.6Audio Model
内容摘要
MiniMax发布语音模型Speech 2.6,端到端延迟降至250毫秒内,支持实时对话。新增多语言特殊格式解析能力,可自动朗读URL、邮箱、电话、日期及金额,无需预处理。推出Fluent LoRA功能,即使源录音带口音也能保留音色并生成流畅语音,支持40余种语言。已被LiveKit、Vapi等平台及智能硬件采用。
综合分类、实体标签与信息来源匹配