AI独角兽MiniMax发布新一代语音大模型Speech-02 荣登国际权威评测双榜榜首
创始人
2025-05-26 08:20:18
0

近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际两项权威语音评测榜单Artificial Analysis和Hugging Face TTS Arena上,力压OpenAI、ElevenLabs等国际巨头,荣登双榜榜首。这一突破性进展,意味着我国在AI语音生成领域已跻身世界领先行列。

上证报中国证券网讯(记者 孙小程)近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际两项权威语音评测榜单Artificial Analysis和Hugging Face TTS Arena上,力压OpenAI、ElevenLabs等国际巨头,荣登双榜榜首。这一突破性进展,意味着我国在AI语音生成领域已跻身世界领先行列。

据介绍,Speech-02在语音模型核心技术指标字错率WER和相似度SIM等客观指标上取得了SOTA结果,用户盲听主观评价反馈也更自然、真实。具体来看,与Seed-TTS、CosyVoice 2和真实音频相比,Speech-02在中英文的零样本语音克隆中均实现了更低的WER,表明其发音错误率更低且更清晰稳定。在SIM方面,Speech-02在所有24种测试语言中均显著优于ElevenLabs的multilingual_v2模型,前者生成的语音更逼近真人输出。

基于超强技术与足够泛化的模型能力,Speech-02为用户带来超拟人、个性化、多样性的语音服务。Speech-02通过“文生音”功能给定自然语言文本描述生成符合描述的音色;通过“声音参考”功能,对任意给定语音实现灵活控制,进行感情、语速、音高、语种等无缝切换;同时,支持粤语、葡萄牙语、法语等32个语种,甚至在同一段语音里也可以实现多个语种间的自如切换。

值得关注的是,Speech-02商用定价仅为全球头部语音模型ElevenLabs的四分之一,以超高性能和极致性价比双重优势,推动国产AI语音技术大规模商业化落地。

目前,MiniMax已在文旅导览、金融服务、语音助手、AI教育等应用服务;AI玩具、教育学习机、汽车智能座舱等硬件场景形成成熟解决方案,并与国内外多家知名企业达成深度合作,包括国内声网、阅文集团旗下起点读书、高途教育、香港电视台,以及海外Hedra、Moescape AI、Dusmart等机构。

今年1月,MiniMax发布Speech-01语音模型,支持17种语言和上百种音色,快速在北美、英国、澳大利亚、日韩、意大利、巴西等20多个国家和地区实现落地合作。

相关内容

热门资讯

平桂区:一屏中控管全线 昔日矿... 近日,走进贺州市平桂区碳酸钙产业园,智能化密闭生产线有序运转,中控室内操作人员轻点按键即可调控研磨、...
星辰云图智造“未来”扑面已至 来源:滚动播报 (来源:运城新闻网) 户外,清洁机器人按照既定路线匀速行进,边清扫边吸尘,所过之处一...
原创 别... ## 月球将在近期的傍晚天空中短暂遮掩金星,上演一场罕见的天象。此外,这段时间还会出现明亮的行星...
我国高质量数据迎来价值释放大年... 6 月 8 日,国家数据局正式印发《关于推进行业高质量数据集建设行动的实施方案》(下称《方案》),标...
欧盟对Meta采取临时措施,限... (来源:经济日报) 转自:经济日报 当地时间9日,欧盟反垄断监管机构要求美国脸书母公司Meta开放旗...
原创 信... 通体焦黑、表面布满烧蚀斑痕的返回舱稳稳落在戈壁上,乍一看像是刚从一场大火里被拖出来。可几十分钟前,它...
一加 Turbo 6X Pro... 【CNMO】在智能手机市场拼参数、拼影像、拼AI的今天,有一类用户其实一直在默默等待一款产品——不追...
静候八方宾客!第10届南博会布... 第10届中国—南亚博览会开幕在即,昆明滇池国际会展中心处处都是忙碌的身影。连日来,各个展馆的展台搭建...
高颜值手机推荐:华为 Pura... 在手机审美愈发多元的时代,一款真正好看的手机,从来不是单一的配色出彩,而是色彩美学、精致工艺、好屏质...
天气与气候科学的AI革命:真革... 当下,AI几乎无处不在——无论是你打字时被数字"助手"不断打断,还是想买一台不需要联网的冰箱却发现难...