极客API
极客API
概览模型中心接入密钥使用记录任务记录生图测试生视频测试API 文档
充值
API 文档
API 文档
统一调用 API模型与能力文本生成视频生成图片生成音频生成任务与错误

音频生成

本平台统一音频生成 API 规范

音频生成接口兼容 OpenAI Speech API。

创建音频

POST /v1/audio/speech
curl https://your-domain.example/v1/audio/speech \-H "Authorization: Bearer sk-你的令牌" \-H "Content-Type: application/json" \-o speech.mp3 \-d '{  "model": "elevenlabs-v3",  "input": "欢迎使用本平台统一 API。",  "voice": "alloy",  "response_format": "mp3",  "speed": 1}'

统一字段

字段类型说明
modelstring本平台音频模型值,必填。
inputstringOpenAI speech 兼容文本字段。
textstring文本别名;部分上游使用该字段。
voicestring声音 ID,由具体模型和渠道支持情况决定。
response_formatstring输出格式,如 mp3、wav。
speednumber语速,支持范围由上游模型决定。

模型能力

模型值系列音频生成调用规则说明
elevenlabs-v3ElevenLabs支持通过 /v1/audio/speech 提交文本转语音。字段以 OpenAI speech 兼容格式为主,voice 由上游渠道支持情况决定。

响应

语音接口通常直接返回音频二进制内容,Content-Type 取决于 response_format 和上游返回格式。客户端应把响应体保存为对应音频文件。

图片生成

本平台统一图片生成 API 规范

任务与错误

视频异步任务状态、轮询方式和常见错误

On this page

创建音频统一字段模型能力响应