AI独角兽MiniMax发布新一代语音大模型Speech-02 荣登国际权威评测双榜榜首
创始人
2025-05-26 08:20:18
0

近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际两项权威语音评测榜单Artificial Analysis和Hugging Face TTS Arena上,力压OpenAI、ElevenLabs等国际巨头,荣登双榜榜首。这一突破性进展,意味着我国在AI语音生成领域已跻身世界领先行列。

上证报中国证券网讯(记者 孙小程)近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际两项权威语音评测榜单Artificial Analysis和Hugging Face TTS Arena上,力压OpenAI、ElevenLabs等国际巨头,荣登双榜榜首。这一突破性进展,意味着我国在AI语音生成领域已跻身世界领先行列。

据介绍,Speech-02在语音模型核心技术指标字错率WER和相似度SIM等客观指标上取得了SOTA结果,用户盲听主观评价反馈也更自然、真实。具体来看,与Seed-TTS、CosyVoice 2和真实音频相比,Speech-02在中英文的零样本语音克隆中均实现了更低的WER,表明其发音错误率更低且更清晰稳定。在SIM方面,Speech-02在所有24种测试语言中均显著优于ElevenLabs的multilingual_v2模型,前者生成的语音更逼近真人输出。

基于超强技术与足够泛化的模型能力,Speech-02为用户带来超拟人、个性化、多样性的语音服务。Speech-02通过“文生音”功能给定自然语言文本描述生成符合描述的音色;通过“声音参考”功能,对任意给定语音实现灵活控制,进行感情、语速、音高、语种等无缝切换;同时,支持粤语、葡萄牙语、法语等32个语种,甚至在同一段语音里也可以实现多个语种间的自如切换。

值得关注的是,Speech-02商用定价仅为全球头部语音模型ElevenLabs的四分之一,以超高性能和极致性价比双重优势,推动国产AI语音技术大规模商业化落地。

目前,MiniMax已在文旅导览、金融服务、语音助手、AI教育等应用服务;AI玩具、教育学习机、汽车智能座舱等硬件场景形成成熟解决方案,并与国内外多家知名企业达成深度合作,包括国内声网、阅文集团旗下起点读书、高途教育、香港电视台,以及海外Hedra、Moescape AI、Dusmart等机构。

今年1月,MiniMax发布Speech-01语音模型,支持17种语言和上百种音色,快速在北美、英国、澳大利亚、日韩、意大利、巴西等20多个国家和地区实现落地合作。

相关内容

热门资讯

打卡北京通信电信博物馆:穿越1... 21世纪经济报道记者郑青亭、实习生贺一然 北京报道 你知道吗?在北京西城区的骡马市大街9号,藏着一座...
原创 “... 众所周知,对于如今的智能手机行业来说,“跑分”依然是一种具备相当参考价值、衡量设备硬件性能和软件调校...
浪潮电子申请一种液冷散热动态流... 金融界2025年8月18日消息,国家知识产权局信息显示,浪潮电子信息产业股份有限公司申请一项名为“一...
宏晶源化学取得生物化工产品制备... 金融界2025年8月18日消息,国家知识产权局信息显示,河北宏晶源化学有限公司取得一项名为“一种生物...
“用友BIP 5”发布 助力A... 本报讯 (记者向炎涛)8月15日至17日,由用友网络科技股份有限公司(以下简称“用友”)主办的202...
阿尔法起重机:创新驱动发展 责... 在享有“中国起重机械之都”美誉的河南长垣经济技术开发区,阿尔法起重机有限公司的智能化车间里,工人们在...
新疗法让细菌与病毒组成抗癌“战... 新华社洛杉矶8月17日电 美国研究人员开发出一种抗癌新疗法:让细菌与病毒组成“战队”,一同攻入肿瘤内...
原创 “... 地衣看上去微小脆弱,却能分泌地衣酸,日积月累地腐蚀、碎裂坚硬岩石。它们不是要炸毁岩石,而是通过持续的...
萤火虫航天拟在日本发射火箭,开... 来源:环球市场播报 日本一家在北海道运营航天发射场的公司周一表示,美国火箭制造商萤火虫航天(Fire...
《云手机ios出租:哪个云手机... **一、云手机的兴起与优势** 随着科技的发展,云手机逐渐走进人们的视野。云手机是一种基于云计算...