Skip to content

Gemini 图片生成(Gemini原生格式)

OpenAI 兼容的图像接口 外,YouQi AI 还支持 Gemini 原生的图片生成模型,复用 generateContent 端点,通过 responseModalitiesimageConfig 请求图像输出。同一分组内还有 OpenAI聊天格式(通过 /v1/chat/completions 调用)。

接口地址

POST /v1beta/models/{model}:generateContent

Base URL 与认证方式同 Gemini 文本聊天https://ai.youqi.tech/v1beta,通过 ?key= 查询参数或 x-goog-api-key 头传递密钥。

请求参数

参数类型必填说明
contents[].parts[].textstring图像描述提示词
generationConfig.responseModalitiesarray固定为 ["IMAGE"]
generationConfig.imageConfig.aspectRatiostring宽高比,如 1:116:9
generationConfig.imageConfig.imageSizestring图像尺寸档位,如 1K2K

请求示例

bash
curl "https://ai.youqi.tech/v1beta/models/gemini-2.5-flash-image:generateContent?key=sk-YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      { "parts": [{ "text": "一只在星空下奔跑的白色狐狸,写实风格" }] }
    ],
    "generationConfig": {
      "responseModalities": ["IMAGE"],
      "imageConfig": { "aspectRatio": "1:1", "imageSize": "1K" }
    }
  }'

响应示例

图像以 Base64 内联数据形式包含在返回的 parts 中:

json
{
  "candidates": [
    {
      "content": {
        "role": "model",
        "parts": [
          {
            "inlineData": {
              "mimeType": "image/png",
              "data": "BASE64_ENCODED_IMAGE_DATA"
            }
          }
        ]
      },
      "finishReason": "STOP"
    }
  ],
  "usageMetadata": {
    "promptTokenCount": 15,
    "candidatesTokenCount": 0,
    "totalTokenCount": 15
  }
}

提示

若只需通用文生图能力,/v1/images/generations(OpenAI 兼容格式)覆盖更多模型且更简单。是否支持 thinkingConfig(思考过程)等扩展字段取决于所选模型。