Prompt generation
根据一段描述快速生成音乐
- 输入
- 类型、情绪、乐器、速度、用途和歌词方向
- 结果
- 完整歌曲或纯音乐
| 只修改歌曲中的一个片段 | Inpainting | 已有歌曲、目标区段与修改要求 | 保留其余内容的局部新版本 |
Prompt generation
Composition plan
Audio Reference
Inpainting
Music v2 覆盖从完整歌曲创作到局部修改的多种方式。你可以根据文字生成音乐,也可以按段落扩展歌曲、用参考音频确定声音方向,或只调整其中一个区段。

Music v2
文字生成是最直接的入口。提示词可以写明类型、年代感、情绪、速度、乐器、人声、语言、结构和使用场景,也可以要求只生成纯音乐。
适合 广告配乐、内容音乐、歌曲草案和产品内音乐生成
Long-form composition
Music v2 支持把歌曲拆成前奏、主歌、副歌、桥段和尾奏等区段,再逐段扩展。结构化创作比只写一段总提示词更适合需要固定歌词与编排的完整歌曲。
References and inpainting
参考音频用于引导新作品的整体声音、制作风格、配器、速度和情绪,并不等同于复制或混音原曲。局部重绘则用于重新生成选定区段,同时保留歌曲其他部分。
说明音乐用于广告、播客、短视频、游戏、产品还是歌曲创作,并写明受众、时长与发布环境。
写明类型、情绪、速度、拍号、乐器、人声、语言、制作质感和动态变化,避免只写一个宽泛风格词。
快速配乐可从文字描述开始;完整歌曲可提前规划前奏、主歌、副歌、桥段、歌词和各段目标。
生成后可以比较旋律、节奏、人声、歌词和段落衔接,再针对副歌、桥段或其他具体区段继续调整。
比较旋律、歌词、人声和编曲效果,选出最符合使用场景的一版,完成整首音乐的制作。
开始前,先想清楚音乐会用在哪里、希望听起来怎样,再准备歌词、段落和参考音频。下面五项可以帮助你把需求写得更完整。
01
列出用途、受众、情绪曲线、时长、速度、乐器、人声、语言、结构和不能出现的元素。
02
需要人声时先确定歌词语言、押韵、视角、段落和敏感表达;完整歌曲可规划前奏、主歌、副歌、桥段与尾奏。
03
如果你有自己的 demo、旋律片段或配器参考,可以用它说明想要的节奏、氛围、乐器和制作风格。
04
可以从旋律、歌词、发音、品牌适配、音质和内容表达几个方面比较不同版本,选出最符合实际用途的一版。
05
把提示词、歌词和试听版本分别保存下来,方便比较旋律、人声和编曲,最后挑出最适合发布的一版。
根据自然语言音乐描述生成带人声歌曲,也可以明确要求纯音乐。提示词可以同时约束类型、情绪、乐器、速度和结构。
Music v2 可以处理快速说唱、密集歌词、音域变化和更复杂的演唱方式,并提升多语言歌词与人声表现。
可以按前奏、主歌、副歌、桥段和尾奏组织歌曲,让不同区段在继续扩展时保持结构与连续性。
Music v2 可以在一首歌曲内部处理风格变化,也能把非音乐音效写进整体编排,适合需要情节推进或场景变化的音乐。
参考音频可以为新作品提供声音、制作风格、配器、速度和情绪方向,让生成结果更接近想要表达的音乐感觉。
选择歌曲中的一个区段重新生成,可以调整桥段或副歌而不必从头生成整首作品。
根据品牌语气、受众、镜头节奏和情绪曲线创作定制配乐,适合广告、产品发布和品牌内容。
为固定栏目制作片头、片尾、转场或背景音乐,并通过明确乐器、节奏和记忆点保持栏目声音一致。
用场景、危险程度、角色和节奏描述快速制作关卡音乐或互动原型,适合探索不同氛围和节奏方向。
把歌词、段落结构、演唱方向和配器要求组合成歌曲草案,用于讨论旋律、节奏、结构和制作方向。
可以为不同语言分别准备歌词和发音说明,比较人声表达与编曲效果,选择更符合目标听众的一版。
适合在创作者工具、内容平台或互动应用中加入音乐生成功能,让用户根据文字描述、歌词或场景要求制作歌曲和配乐。
Create a 35-second instrumental electronic track for a premium technology product launch. Start with restrained glassy synth pulses, build with precise percussion and warm sub-bass, then resolve into a confident three-note motif. Modern, spacious, no vocals, no retro arcade sounds.用途、时长、配器、动态结构、记忆点和排除项都写清楚,比只写‘科技感电子音乐’更容易得到可用结果。
Write a Mandarin city-pop song about leaving the office late and choosing to walk home through summer rain. Female alto vocal, 112 BPM, clean electric guitar, warm analog synths, melodic bass, restrained verses and a bright sing-along chorus. Use natural contemporary Mandarin and avoid cliché neon imagery.提示词同时规定了叙事、语言、声音、速度、配器、段落反差和禁用意象,便于控制人声与歌词方向。
Create a 12-second instrumental intro for a weekly science podcast. Curious but credible, 96 BPM, marimba accents, muted drums, soft modular synth texture, and a clean ending that leaves room for a spoken title. No cinematic boom and no vocals.短片头要说明旁白空间与结尾方式,否则音乐可能过满或不方便剪辑。
Compose a seamless-feeling two-minute track for an underwater exploration level. Slow 6/8 pulse, bowed glass, low strings, distant metallic percussion and occasional whale-like synthetic tones. Begin calm, introduce unease after the first third, and end unresolved. Instrumental, immersive, not horror.场景、拍号、配器、时间推进与情绪边界共同决定关卡音乐,而不只是一个类型标签。
你可以先完成账户、API Key、等待上线之后立即使用
在同一账户中管理余额、API Key、任务记录和已上线模型。
把 API Key 保存在服务端环境变量或密钥管理工具中,不要放进浏览器代码、截图或公开仓库。
可以先使用 MiniMax Music 2.6 测试音乐描述、任务提交、状态查询、文件试听和用量记录。
Eleven Music v2 是 ElevenLabs 的新一代 AI 音乐模型,可根据文字生成带人声歌曲或纯音乐,并支持更复杂的人声、多语言输出、长篇分段创作、风格切换、参考音频和局部重绘。
暂时不可以。HiAPI 正在完成 Music v2 的接入与上线验证。本页目前只提供预上架信息与上线提醒,不提供任务提交、价格或 API 参数。
ElevenLabs 的音乐产品与 API 覆盖从短片段到长篇作品。HiAPI 上线后的实际时长范围会在最终文档中公布。
可以。Music v2 支持带歌词的人声歌曲、多语言演唱、快速说唱和密集歌词,也可以生成纯音乐。歌词、语言、人声方向和结构写得越清楚,生成目标越明确。
它把歌曲拆成前奏、主歌、副歌、桥段和尾奏等区段,再按顺序构建和扩展,而不是只生成一个短片段。这样更适合完整歌词、明确结构和持续发展的编曲。
不会。Audio Reference 用于引导声音、制作风格、配器、速度和情绪,生成的是一首新的作品,不会直接复制或混音参考歌曲。
局部重绘用于重新生成歌曲中的选定区段,例如桥段、副歌或某段歌词对应的音乐,同时保留歌曲其他部分。修改要求应明确指出区段、问题和期望变化。
建议写明用途、听众、类型、情绪、速度、拍号、乐器、人声、语言、结构、动态变化和排除项。需要歌词时,还要说明主题、视角、段落和表达方式。
是否可以商用取决于所选 ElevenLabs 计划和具体发布场景。准备投放广告、流媒体、影视或游戏时,可以查看最新 Music Terms 对应的使用范围。
MiniMax Music 2.6 已经可以根据文字和歌词生成歌曲,适合先比较音乐 Brief、语言、人声和编曲方向。ElevenLabs Text to Dialogue 则适合补充对白、角色语音和旁白。