AI独角兽MiniMax发布新一代语音大模型Speech-02 荣登国际权威评测双榜榜首
创始人
2025-05-26 08:20:18
0

近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际两项权威语音评测榜单Artificial Analysis和Hugging Face TTS Arena上,力压OpenAI、ElevenLabs等国际巨头,荣登双榜榜首。这一突破性进展,意味着我国在AI语音生成领域已跻身世界领先行列。

上证报中国证券网讯(记者 孙小程)近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际两项权威语音评测榜单Artificial Analysis和Hugging Face TTS Arena上,力压OpenAI、ElevenLabs等国际巨头,荣登双榜榜首。这一突破性进展,意味着我国在AI语音生成领域已跻身世界领先行列。

据介绍,Speech-02在语音模型核心技术指标字错率WER和相似度SIM等客观指标上取得了SOTA结果,用户盲听主观评价反馈也更自然、真实。具体来看,与Seed-TTS、CosyVoice 2和真实音频相比,Speech-02在中英文的零样本语音克隆中均实现了更低的WER,表明其发音错误率更低且更清晰稳定。在SIM方面,Speech-02在所有24种测试语言中均显著优于ElevenLabs的multilingual_v2模型,前者生成的语音更逼近真人输出。

基于超强技术与足够泛化的模型能力,Speech-02为用户带来超拟人、个性化、多样性的语音服务。Speech-02通过“文生音”功能给定自然语言文本描述生成符合描述的音色;通过“声音参考”功能,对任意给定语音实现灵活控制,进行感情、语速、音高、语种等无缝切换;同时,支持粤语、葡萄牙语、法语等32个语种,甚至在同一段语音里也可以实现多个语种间的自如切换。

值得关注的是,Speech-02商用定价仅为全球头部语音模型ElevenLabs的四分之一,以超高性能和极致性价比双重优势,推动国产AI语音技术大规模商业化落地。

目前,MiniMax已在文旅导览、金融服务、语音助手、AI教育等应用服务;AI玩具、教育学习机、汽车智能座舱等硬件场景形成成熟解决方案,并与国内外多家知名企业达成深度合作,包括国内声网、阅文集团旗下起点读书、高途教育、香港电视台,以及海外Hedra、Moescape AI、Dusmart等机构。

今年1月,MiniMax发布Speech-01语音模型,支持17种语言和上百种音色,快速在北美、英国、澳大利亚、日韩、意大利、巴西等20多个国家和地区实现落地合作。

相关内容

热门资讯

“彩光”成园区网新宠:锐捷等厂... 在数字化转型浪潮席卷全球的当下,从智慧教育到智能制造,各行各业对底层网络基础设施的需求正经历着前所未...
4100多项高校院所科技成果发... 本报南京9月11日电 (记者王伟健、姚雪青)2025江苏产学研合作对接大会11日在江苏南京开幕。会上...
马斯克:星链手机预计两年左右发... 当地时间9月9日,马斯克在All-In Summit 2025中阐述了Optimus(擎天柱)机器人...
iQOO 15真机图曝光!延续... 【CNMO科技消息】9月11日,有数码博主曝光了一张可能是iQOO 15的真机图。从图片来看,新机采...
你上过“仿冒名人”的当吗?各平... 转自:中国消费者报 近期,包括全红婵在内多位奥运冠军的声音被AI克隆,用到短视频平台冒充本人带货农产...
太重集团:全力攀登国际一流竞争... 提及我国重型机械领域的“国家队”,太原重型机械集团有限公司(以下简称“太重集团”)的名字掷地有声。自...
浙江提速机器人产业标准化建设 中新社杭州9月10日电 (奚金燕)浙江市场监管助推智能机器人高质量发展大会10日在杭州举办。会上启动...
从“秀场”到“工厂”,机器人工... 新华网记者 陈凯茵 赵宇娇 今年年初,人形机器人登上春晚舞台跳起“秧歌”;不久前,在北京举办的202...
2025智博会落幕,中国电信以... 在刚刚闭幕的世界智能产业博览会上,中国电信以“算网一体·智惠未来”为核心主题,通过一系列技术发布、成...
AI浪潮席卷SEMICON T... 9月10日-12日,SEMICON Taiwan 2025在台北南港展览馆盛大举行,一场由人工智能(...