ElevenLabs 服务介绍
欢迎使用 ElevenLabs 服务文档! ElevenLabs 提供 AI 驱动的音乐生成(支持结构化作曲计划精细控制)、视频配乐、音轨分离,以及多角色对话合成能力。支持的模型
音乐
对话
功能一览
音乐生成
从简单文本提示或详细作曲计划生成音乐,支持段落级别精细控制
作曲计划
AI 生成结构化计划,包含段落、风格和歌词 — 免费,不消耗积分
视频配乐
根据视频内容自动生成匹配的背景音乐
音轨分离
将音频分离为 2 轨(人声+伴奏)或 6 个独立音轨
音色列表
浏览可用音色(同步,不消耗积分),供对话合成选用
多角色对话
合成多角色对话,最多支持 10 个不同音色
如何使用 ElevenLabs
音乐生成
1
选择输入方式
使用简单的
prompt 快速生成,或通过 /eleven/plan 创建 compositionPlan 来精细控制段落、风格和歌词。2
生成音乐
调用
POST /eleven/music 传入提示词或作曲计划,获取 taskId。3
轮询结果
使用
GET /eleven/tasks?taskId=xxx 轮询直到状态为 completed,结果包含生成的音频及元数据(歌词时间戳、作曲计划等)。对话合成
1
获取音色
调用
GET /eleven/voices 获取可用 voiceId(同步,不消耗积分)。2
创建对话任务
调用
POST /eleven/dialogue,传入 inputs[](text + voiceId),获取 taskId。3
轮询音频
使用
GET /eleven/tasks?taskId=xxx 轮询直到 completed,再读取 result.audioUrl。快速示例
可用端点
两种输入模式
ElevenLabs 支持两种互斥的音乐生成输入方式:1. 简单提示模式
提供文本prompt 描述所需音乐,简单快捷,AI 自动处理所有细节。
2. 作曲计划模式
使用结构化的compositionPlan,按段落精细控制风格、时长和歌词。可先通过 /eleven/plan 自动生成计划,再自定义后生成。
输出格式
ElevenLabs 通过outputFormat 参数支持多种输出格式:
完整格式列表请查看音乐生成端点文档。