极客API
极客API
概览模型中心接入密钥使用记录任务记录生图测试生视频测试API 文档
充值
API 文档
API 文档
统一调用 API模型与能力文本生成视频生成图片生成音频生成任务与错误

模型与能力

本平台模型值、能力分类和模型列表接口

模型值是本平台对外暴露的稳定名称。业务方只需要传本平台模型值,平台会根据渠道配置和请求字段选择对应上游接口。

列出模型

GET /v1/models
curl https://your-domain.example/v1/models \-H "Authorization: Bearer sk-你的令牌"

返回结构兼容 OpenAI 模型列表格式。模型是否可用还会受账号分组、令牌限制、余额、渠道状态影响。

模型值规则

  • model 必填,必须使用本平台发布的模型值。

文本模型能力

模型值系列Chat CompletionsResponses流式输出工具调用JSON 输出调用规则说明
gemini-3.5-flashGemini支持支持支持部分支持部分支持通过 /v1/chat/completions 或 /v1/responses 提交。工具调用和 JSON 输出取决于当前渠道兼容能力,建议业务侧做结果校验。
gemini-3-pro-previewGemini支持支持支持部分支持部分支持通过 /v1/chat/completions 或 /v1/responses 提交。预览模型能力可能随上游调整;工具调用和 JSON 输出取决于当前渠道兼容能力。

工具调用和 JSON 输出为兼容能力,具体支持程度取决于当前模型渠道;需要严格结构化输出时建议业务侧校验。

视频模型能力

模型值显示名称文生视频图生视频参考图生视频视频参考音频参考首尾帧全能参考自动识别规则限制
正在读取已启用的全局视频模型…

表格根据当前已启用的全局视频模型及其规则生成;视频参考使用 videoUrls,音频参考使用 audioUrls;全能参考表示可组合接收多种参考输入。

图片模型能力

模型值系列文生图图生图自动识别规则限制
gpt-image-2OpenAI Image支持支持无图片按文生图;有 image/images/imageUrl 按图生图或参考图。支持 size 推导 aspectRatio/resolution;参考图字段会归一为 imageUrls。
gemini-3-pro-imageGemini Image支持支持无图片按文生图;有 image/images/imageUrl 按图生图或参考图。支持 size 推导 aspectRatio/resolution;参考图字段会归一为 imageUrls。

图生图为参考图能力,不等同于带 mask 的局部编辑。

音频模型能力

模型值系列音频生成调用规则说明
elevenlabs-v3ElevenLabs支持通过 /v1/audio/speech 提交文本转语音。字段以 OpenAI speech 兼容格式为主,voice 由上游渠道支持情况决定。

能力术语

能力含义
文本生成通过 messages 或 input 生成文本回复。
流式输出传 stream: true,用 SSE 持续接收增量内容。
工具调用传 tools 和 tool_choice,让模型返回函数调用意图。
JSON 输出通过 response_format 或提示词约束输出 JSON。
文生视频只传 prompt,不传图片、视频、音频输入。
图生视频推荐传单张图片统一字段 imageUrl。入口仍兼容 image、image_url。
参考图生视频推荐传多张参考图统一字段 imageUrls。入口仍兼容 images、image_urls。
视频参考推荐传参考视频统一字段 videoUrls。入口仍兼容 video、videoUrl、video_urls。
音频参考推荐传参考音频统一字段 audioUrls。入口仍兼容 audio、audioUrl、audio_urls。
首尾帧生视频同时传统一字段 firstFrameUrl 和 lastFrameUrl。
全能参考在同一套规范字段中组合接收参考图、参考视频、参考音频等多媒体输入。
文生图只传 prompt 生成图片。
图生图传 image、imageUrl、images 等图片输入作为参考或编辑输入。

统一调用 API

面向业务接入的二次封装统一 AI API

文本生成

本平台统一文本生成 API 规范

On this page

列出模型模型值规则文本模型能力视频模型能力图片模型能力音频模型能力能力术语