
面向开发者的 AI API
AI 音乐生成 API
通过 PoYo AI 音乐生成 API 接入歌曲与配乐创作。对比模型的曲风、歌词、人声、纯音乐和编辑选项,规划自动化音乐生产。
匹配模型
3 个模型

$0.64 /分钟(不足按分钟计)
elevenlabs-music
Generate studio-grade AI music with prompt-based songs, instrumental mode, structured composition plans, section timing, multilingual vocals, and flexible audio output formats.

$0.10 /次生成
minimax-music-2.6
Generate complete songs from style prompts and lyrics with MiniMax Music 2.6. Supports vocal tracks, instrumental generation, prompt-driven lyrics optimization, and configurable audio output settings.

$0.10 /次生成
generate-music
AI music generator with customizable styles, vocals, and full creative control over musical characteristics and quality.
音乐模型 API - 价格和模型适配
选择模型前,对比供应商、支持的输入、输出格式和价格。
精确任务匹配
只有模型目录元数据包含 Music 的模型才会出现在这里。
供应商对比
无需离开任务目录,即可查看不同供应商的模型系列。
API 就绪路径
每张模型卡都会跳转到 PoYo 的价格、示例、Playground 控件和 API 详情。
| 模型 | 供应商 | 任务类型 | 价格 |
|---|---|---|---|
| ElevenLabs Music elevenlabs-music | ElevenLabs | Music | $0.64/分钟(不足按分钟计) |
| MiniMax Music 2.6 minimax-music-2.6 | MiniMax | Music | $0.10/次生成 |
| Suno Music generate-music | PoYo | Music | $0.10/次生成 |
常见问题
什么是 AI 音乐生成 API?
+
AI 音乐生成 API 根据提示词、歌词等支持的输入创作音乐,可接入歌曲、配乐和应用内音乐功能。人声、纯音乐与编辑能力以具体模型和接口为准。
如何描述想生成的音乐?
+
说明曲风、情绪、乐器、强度和是否需要人声,有结构控制时再补充段落要求。明确的简报比互相冲突的风格列表更易评估,先测试代表性创意再扩大生产。
歌曲生成 API 可以使用自己的歌词吗?
+
部分接口接受自定义歌词,其他接口使用不同提示词或编曲控制。核对字段、长度和语言表现,使用有权提交的歌词,并检查生成后的发音与断句。
可以生成没有人声的纯音乐吗?
+
使用模型支持的纯音乐选项或模式,提供明确编曲方向,并试听是否出现意外人声。不能假定所有模型只要省略歌词就会得到相同行为。
如何选择音乐模型?
+
用相同曲风、人声语言和目标时长比较结构、清晰度、乐器与过渡。结合重试次数评估可用曲目成本,最低生成价未必对应最低成品成本。
可以续写歌曲或替换局部段落吗?
+
模型支持时,应使用专门续写或编辑接口。这些操作可能需要已有任务、曲目标识与时间参数,不能一律当作新的普通生成请求。
音乐生成自动包含分轨、MIDI 和格式转换吗?
+
这些是独立音频操作,并非每次歌曲生成都包含。查看模型家族支持的分离、转换或 MIDI 流程,遵循上游任务关联与文件要求。
支持哪些格式和曲目长度?
+
由具体模型和操作决定,按文档选择音频格式与设置,并核对完成响应。需要后续编辑时选择合适格式,同时保存继续编辑所需的曲目标识。
如何通过 API 获取生成歌曲?
+
按文档提交音乐模型与输入,保存 task_id,通过状态查询或支持的 callback_url 获取音频。将曲目元信息与文件关联保存,方便后续续写和编辑。
AI 音乐 API 如何计费?
+
生成、续写、分轨和转换可能使用不同单位与费率。应估算完整工作流及创意尝试次数,不能将歌曲生成起始价直接用于所有后续操作。
生成的音乐可以商用吗?
+
商用前查看模型与服务条款,确认歌词、录音等来源素材的权利。任务完成本身不能确定授权、署名或第三方权利,应保留项目需要的许可记录。
曲目不符合要求时如何改善?
+
先区分问题属于风格、人声、结构还是时长,再调整对应指令。简化冲突参考,使用已支持的段落控制,并试听完整曲目,不能只根据开头判断质量。