ElevenLabs 发布 Music v2:生成式音乐迎来全新纪元,支持全曲结构与多语言精准创作

ADK ElevenLabs官方 / ADK编译 2026-05-26 4 分钟 108 次浏览
速览导读 / Summary

ElevenLabs 正式推出 Music v2 模型,全面升级其音乐生成能力。该版本在保持音乐连贯性的同时,支持从歌剧到重金属的复杂风格切换、全曲分段构建及精细的局部重绘(inpainting)。Music v2 赋能 ElevenMusic、ElevenAPI 和 ElevenCreative 三大平台,并大幅降低 API 与自助服务价格,同时获得 Believe 等版权方合作,确保商业合规使用。

模型版本 Music v2 全曲结构生成与精细控制能力升级
价格优惠 最高 50% API 与自助服务客户价格下调
支持功能 Inpainting + 分段构建 新增局部重绘与全曲分段创作能力

Key Insights / 核心看点

  • 1 支持全曲分段构建(Intro, Verse, Chorus),实现从片段生成到完整歌曲创作的跨越。
  • 2 具备精细化的局部重绘(Inpainting)能力,可单独修改歌曲特定段落而不影响整体。
  • 3 大幅降低 API 与自助服务价格(最高 50%),并获 Believe 等版权方合作,确保商业合规。
  • 4 显著提升多语言支持,歌词、人声与编曲在多语种环境下表现更可靠。
  • 5 赋能三大平台(ElevenMusic, ElevenAPI, ElevenCreative),覆盖音乐人、开发者与品牌全场景。

ElevenLabs 发布 Music v2:生成式音乐迎来全新纪元

ElevenLabs 近日宣布推出其音乐生成领域的重大突破——Music v2。作为继 Music v1 之后的迭代版本,Music v2 不仅在音质、乐器编排和多语言支持上实现了质的飞跃,更在创作灵活性上迈出了关键一步,标志着 AI 音乐生成从“片段生成”向“全曲创作”的跨越。

核心突破:从片段到全曲的架构升级

Music v2 最引人注目的特性在于其对音乐连贯性(Musical Coherence)的极致追求。与早期版本只能生成短片段不同,Music v2 允许用户像构建传统歌曲一样,按段落(Intro, Verse, Chorus 等)逐步构建完整曲目。

  • 跨风格无缝切换:模型能够在一首歌曲中流畅地跨越不同风格,例如从歌剧无缝过渡到重金属,或在一段内维持快节奏说唱与密集歌词的同步,而不会破坏整体结构。
  • 精细化局部重绘(Inpainting):开发者现在可以针对歌曲的特定部分(如副歌或桥段)进行再生成,仅修改该部分而不影响其余段落,极大地提升了后期制作的效率。
  • 多语言与多语种优化:歌词、人声与编曲在多语言环境下的表现更加可靠,支持的语言列表持续扩展,解决了以往多语种音乐生成的准确性痛点。

三大平台赋能:音乐人、开发者与品牌

Music v2 作为底层引擎,驱动了 ElevenLabs 旗下的三个核心平台,针对不同用户群体提供定制化解决方案:

  1. ElevenMusic(面向音乐人与创作者):提供类似专业录音棚的体验。用户可从歌词、情绪或参考曲目出发,开发成完整作品,或发现并重新混音(Remix)现有曲目。
  2. ElevenAPI(面向开发者):提供直接访问模型的能力,支持程序化生成、局部重绘及参考匹配(Reference-match),可无缝嵌入到任何需要定制音乐的产品中。
  3. ElevenCreative(面向品牌与内容团队):专注于规模化处理已获许可的音乐。用户可通过“声音情绪、流派、节奏、品牌声线”等创意简报生成音乐,无需版权同步费,规避了法律风险。

商业价值与生态合作

此次更新不仅提升了技术上限,更大幅降低了使用门槛。ElevenLabs 宣布将ElevenAPI 和 ElevenCreative 自助服务客户的 Music v1 及 v2 价格最高降低 50%,使得商业应用更具可行性。

此外,ElevenLabs 正积极构建行业生态,与 Believe 等版权方达成合作,强调 AI 音乐开发的合规性与权利尊重。这意味着生成的每一首歌曲均可用于商业用途,无需担心版权纠纷,为品牌营销、视频制作及广告内容提供了坚实的信任基础。

结语

Music v2 的发布标志着 AI 音乐生成正式进入成熟阶段。它不再仅仅是生成一段旋律的工具,而是成为了能够理解复杂音乐结构、支持多语言创作且具备商业合规性的生产力引擎。无论是独立音乐人、技术开发者还是大型品牌,都能在这一新架构中找到属于自己的创作路径。

“Music v2 是建立在音乐行业日益增长的共识之上的成果,即围绕受许可和尊重版权的 AI 音乐开发进行合作。” —— ElevenLabs 官方团队

Music v2 现已在 ElevenMusic 和 ElevenCreative 上线,并即将在 ElevenAPI 推出。开发者可通过联系销售团队获取早期访问权限,立即体验这一变革性的音乐生成技术。

Music v2 is the model powering products across three ElevenLabs platforms, each built for a different use case. Whether you're creating music, building a product, or making content at scale, there's a purpose-built platform for you.

ElevenLabs 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-09-08

Framer AI 发布 CMS List Field:重构重复内容管理,赋能动态网站构建

Framer 于 2026 年 9 月正式发布 CMS List Field,彻底革新了重复内容(如 FAQ、产品特性)的管理方式。该更新引入原生列表字段,支持通过 Framer Agent 一键迁移旧数据,并优化了编辑器的内容复用与排序能力。此次更新不仅解决了垂直视频嵌入等长期存在的 Bug,还显著提升了大型 CMS 集合的滚动性能,为开发者提供了更强大的动态内容构建工具。

Framer AI官方 / ADK编译 4 分钟
模型发布 2026-09-08

Ajelix 自研 GPU 基础设施并推出企业级 Agentic 平台,解决数据主权与生产落地难题

Agentic AI 平台 Ajelix 宣布投资自建 GPU 计算基础设施,并正式发布面向企业的 Ajelix Enterprise Platform。此举旨在解决企业级 AI 落地中数据不可控、审计困难及中断风险等痛点。新平台提供从智能体编排、RAG 知识库到严格治理的全栈能力,支持私有化部署,助力企业将 AI 从实验阶段平稳过渡到生产运营。

Ajelix官方 / ADK编译 4 分钟
AI 工具 2026-09-08

DreamFace 发布 AI 直播生成器:零设备打造虚拟主播,重塑内容创作流程

DreamFace 正式推出 AI 直播生成功能,彻底消除传统直播对相机、灯光及推流软件的依赖。用户仅需上传照片或选择虚拟形象,配合脚本即可在数分钟内生成具备真实直播节奏与能量的视频。该工具支持游戏、带货、播客等多种模板,让创作者无需露脸即可测试新内容形式,大幅降低内容生产的门槛与试错成本。

DreamFace官方 / ADK编译 3 分钟
技术解读 2026-09-08

Accio Work 发布 F1 电视转播技术深度解析:8K 流媒体与超低延迟架构揭秘

Accio Work 深度编译 F1 TV 如何永久改变体育转播的历程,聚焦于日本市场策略、8K 流媒体技术革新及超低延迟架构。文章揭示了现代体育直播对带宽、编码及 CDN 的极致要求,包括 45% 的带宽消耗增长和亚 200ms 延迟标准。同时探讨了数字观众如何驱动 23 亿美元的周边销售,为开发者与架构师提供了从传统广播向数字化、智能化转型的宝贵案例与技术指标参考。

Accio Work官方 / ADK编译 3 分钟
audio · 免费+付费
★ 5.0 · 120评测
E

ElevenLabs

AI文本转语音,支持包含中文在内的29种语言

ElevenLabs 是AI文字转语音平台,为开发者、创作者和企业提供逼真的语音合成解决方案。核心产品包括文本转语音(支持包括中文在内的 29+ 语言、10,000+ 声音)、AI 配音、语音克隆、音乐生成等功能。平台以超低延迟、情感丰富的语音质量著称,广泛应用在有声书、视频配音、客服中心和内容本地化等场景。

查看 ElevenLabs 使用教程与功能