把图片地址或 base64 放进 content 数组:
{
"model": "gpt-4o-mini",
"messages": [{
"role": "user",
"content": [
{"type": "text", "text": "这张图里有什么?"},
{"type": "image_url", "image_url": {"url": "https://example.com/a.jpg"}}
]
}]
}
base64 写法:"url": "data:image/png;base64,iVBORw0KGgo..."。注意请求体大小限制(Nginx 的 client_max_body_size,宝塔默认 50M),大图建议先上传再传 URL。
curl https://aiapizz.com/v1/images/generations \
-H "Authorization: Bearer sk-你的密钥" \
-H "Content-Type: application/json" \
-d '{"model":"dall-e-3","prompt":"一只戴墨镜的柴犬,扁平插画风格","n":1,"size":"1024x1024"}'
| 端点 | 用途 |
|---|---|
/v1/images/generations | 文生图 |
/v1/images/edits | 图片编辑 / 图生图(multipart,字段含 image、prompt) |
/v1/images/variations | 基于一张图生成变体 |
绘图类模型是按次计费:单次价格 × n(n 的取值以请求里的 n 为准,默认 1)。
| 端点 | 用途 | 形态 |
|---|---|---|
/v1/audio/transcriptions | 语音转文字 | multipart,字段 file、model |
/v1/audio/translations | 语音翻译成英文 | multipart |
/v1/audio/speech | 文字转语音 | JSON,返回音频二进制 |
curl https://aiapizz.com/v1/audio/transcriptions \
-H "Authorization: Bearer sk-你的密钥" \
-F file=@./test.mp3 \
-F model=whisper-1
上传音频时网关会把 model 字段一起改写成上游需要的真实模型名,其余表单字段原样转发。
curl https://aiapizz.com/v1/embeddings \
-H "Authorization: Bearer sk-你的密钥" \
-H "Content-Type: application/json" \
-d '{"model":"text-embedding-3-small","input":["第一段文本","第二段文本"]}'
/v1/rerank 用于重排序(返回相关性分数),字段与上游一致:query、documents、top_n。这两个端点都按 token 计费。
以 /mj/ 和 /suno/ 开头的请求会原样透传给配置了对应服务的上游渠道,路径、请求体、返回体都不改写(这类上游通常是第三方中转实现,接口形态各有差异)。用法与上游服务自身的说明一致,把域名换成本站即可。