分享好友 最新动态首页 最新动态分类 切换频道
昆仑万维Mureka V7.5模型上线,AI音乐创作水平再迎新高度
2025-08-17 12:51

8月11日,昆仑万维SkyWork AI技术发布周正式启动。8月11日至8月15日,每天发布一款新模型,连续五天,覆盖多模态AI核心场景的前沿模型。

截至目前,昆仑万维已经发布SkyReels-A3、Matrix-Game 2.0、Matrix-3D、Skywork UniPic 2.0、Skywork Deep Research Agent模型。8月15日,昆仑万维正式上线Mureka V7.5模型。至此,昆仑万维SkyWork AI技术发布周完美收官。

Mureka V7.5在中文歌曲上的演绎再上新台阶,不仅实现了中文歌曲音色、演奏技法的大幅提升,还完成了中文歌曲咬字与情感表现提升。

首先,基于对中文曲风和元素的强大理解,Mureka的理解模型对传统民歌、戏曲到经典华语流行金曲乃至当代民谣音乐拥有深刻认知。这种在中文音乐多样性与文化特性上的深度积累,使模型在理解和生成中文音乐时,能够更准确地传达其特有的艺术神韵和情感色彩。

其次,为了进一步提升生成音乐中人声表现的真实性与情感深度,我们针对歌曲特点优化了 ASR 技术,使之成为理解模块的有力延伸。这项技术深入到演唱的微观层面,不仅精准识别唱词,更能通过分析真实演唱中的气息运用、情感起伏和唱法细节,智能划分出符合演唱规律的乐句,并确定自然的换气与停顿位置。结合同样精准的乐段识别,显著提升了生成人声的段落清晰度与结构真实感。

这些捕捉到的细粒度演唱信息反馈给生成模型,极大地增强了人声的自然度、呼吸感以及情感表达的真实性,有效削弱了机械感,使 AI 演绎的歌曲在流畅性上更贴近真人演唱,这在处理中文歌曲特有的韵律和气息要求时效果尤为突出。

正是这种结合在文化特性上的独特积累和针对歌曲演唱优化的 ASR 技术所带来的细节洞察,共同构成了我们在中文音乐生成领域的核心竞争力。

Mureka V7.5不仅能「听懂」对音乐旋律与节奏的制作要求,更能深刻理解并再现不同文化语境下,特别是中文音乐中蕴含的细腻情感与艺术表达,从而为生成高度符合目标审美与文化语境、兼具艺术性与真实感的音乐作品,打下坚持技术基础。

同时,在语音模型方向上,昆仑万维语音团队推出MoE-TTS——首个基于MOE的角色描述语音合成框架。

作为面向开放描述(Out-of-domain Descriptions)场景的全新语音合成框架的研究性工作,该技术可让用户通过自然语言描述(例如“清澈的少年音带磁性尾韵”)精准控制声音特征与风格,在仅使用开源数据的条件下,对标甚至超越闭源商业产品的角色贴合度表现。

技术报告:https://teal-aquarius-c17.notion.site/MoE-TTS-Enhancing-Out-of-Domain-Text-Understanding-for-Description-based-TTS-via-Mixture-of-Experts-24e44360bf708040bff3dffe2eef805e

近年来,描述性语音合成虚拟助手、有声创作、数字人等领域展现出巨大潜力。然而,学术界长期受制于描述数据的局限性模型对开放语义的泛化能力不足,导致面对比喻、类比等复杂修辞时,生成的语音往往偏离用户预期。

MoE-TTS的推出有望助力解决这一核心难题。该框架创新性地结合预训练大语言模型(LLM)文本能力语音专家模块(Speech Expert Modules),为文本与语音分别配置专用专家模块,并在Transformer核心结构中引入模态路由,确保各模态独立优化、互不干扰。在冻结文本参数的同时高效对齐跨模态信息,实现“知识零损失”的泛化理解能力。

在涵盖域内与域外描述的双测试集上,MoE-TTS 与主流闭源 TTS 模型进行了六大维度对比评测:MoE-TTS 在风格表现力贴合度(SEA)和整体贴合度(OA)等声学控制上精准度领先,这正是其在复杂描述匹配度上胜出的关键。

MoE-TTS 的发布不仅为学术界提供了可复现的开放描述 TTS 解决方案,也证明了 模态解耦 + 知识冻结迁移 的技术路径在语音合成中的巨大潜力。这一突破有望推动行业从“封闭标签式控制”走向“自然语言自由控制”的新范式,加速数字人、虚拟助手和沉浸式内容创作的体验升级。

MoE-TTS目前仍在迭代中,后续规划将集成至旗下Mureka-Speech平台作为角色配音的基座模型,为全球开发者和创作者提供开放、高效、可定制的描述性语音合成能力。

欢迎全球用户体验全新V7.5模型

探索音乐创作的无限可能!

来源:北国网

免责声明:本文来源于网络,仅代表作者本人观点,与TechWeb无关。凡来源非TechWeb的新闻(作品)只代表本网传播该消息,并不代表赞同其观点。TechWeb对文中陈述、观点判断保持中立,不对所包含内容的准确性、可靠性或完整性提供任何明示或暗示的保证。请读者仅作参考,并请自行承担全部责任。

最新文章
从灵感到成片一站搞定?明略科技开放注册,用AI赋能爆款素材高效生产!
今日,明略科技AI创新产品「妙啊」,正式开放全球注册。这款AI驱动的爆款投流素材一站式工具,能够通过系统化的分析与创作能力,赋能短视频营销内容制作全流程,帮助商家高效搞定投流素材,为电商短视频内容营销打开全新创意可能。图片来源
陈小娜萧山星星工商代理服务部_志趣
我是陈小娜萧山星星工商代理服务部的陈小姐,联系地址是萧山区市心中路万象汇A座,我们公司是在浙江杭州的个体私营公司,公司专注于商业服务,商务服务,注册资金为人民币20万元以下,雇员数量为6--10人,年营业额为:人民币50--100万元,我们的
今晚,大消息!重磅数据将出炉- DoNews
12月11日,市场全天窄幅震荡,三大指数涨跌不一。从板块来看,抖音豆包及消费电子概念股集体大涨,省广集团等多股涨停。大消费股再度走强,零售、食品等方向领涨。上海国企改革概念股表现活跃,市北高新等10余股涨停。机器人概念股走势分化
2025年伊利内蒙古足球超级联赛【第四轮前瞻】
“2025年伊利内蒙古足球超级联赛”小组赛进入关键阶段,第四轮比赛将于本周末打响,多场焦点对决将直接影响各队的出线前景。鄂尔多斯、乌兰察布能否提前锁定八强?巴彦淖尔、兴安盟是否会成为首批被淘汰的球队?赤峰与包头的强强对话又将如
2024电影回望:你想活出怎样的人生?
编者按:2024年是影视娱乐行业面对新情况新问题积极寻求创新与变革的一年。四味毒叔在岁末从电影、长剧、短剧、综艺、演员、网红等六大领域对行业现象进行深入盘点和解读,期望从时代的发展变化中洞察未来趋势。在本期文章中,我们将聚焦电
传承在少年!看京城小画师巧手“画”非遗
张鹏鹏北京光明小学美术教师首先,小画师们要感受非遗魅力,确定非遗主题。小画师们需深入挖掘所选非遗项目的历史渊源、艺术特色与文化内涵,了解背后的文化故事,通过查阅书籍,走访民间艺人,参观博物馆、美术馆和上网等途径收集实物、图
动态 | 旅游目的地新趋势,这个地方成为五一假期热门选择之一_腾讯新闻
今年五一假期,民众出游热情持续高涨,但旅游目的地的选择呈现出新趋势。许多人倾向于生态环境良好、游客相对较少且性价比高的地点。江苏省南通市如东县凭借其独特的自然风光和旅游资源,成为今年五一的热门旅游目的地之一。据南通林克斯温
北京东六环“焕新” 带来城市空间新体验
在东六环改造工程东六环隧道口, 4月20日凌晨4点多,随着交通指示灯变化,工作人员将行驶在原东六环的车辆成功引流到隧道,东六环改造工程正式通车。东六环改造工程地处北京副中心核心区,南起京哈高速,北至潞苑北大街,全长约16.3公里,
古装历史剧排名前10名,《汉武大帝》《贞观之治》《走向共和》上榜
7.《贞观之治》《贞观之治》作为一部以唐朝初期为背景的历史剧,以其严谨的历史还原度和深刻的人物塑造赢得了观众的高度评价。该剧以唐太宗李世民的一生为主线,展现了他在位期间的文治武功,以及唐朝由弱变强的崛起历程。剧中,马跃饰演的
相关文章
推荐文章
发表评论
0评