可用模型
SeeOneAPI 提供以下 Gemini 图片生成模型:
模型都按 Token 用量计费,具体单价以 模型广场 为准。
调用方式
Gemini 图片生成模型不是传统的 Images API(/v1/images/generations),而是具备图片输出能力的对话模型。支持两种调用方式:
方式一:Chat Completions API(推荐)
使用 OpenAI 兼容的 Chat Completions 接口,通过extra_body 传递 Gemini 原生图片配置:
请求参数
extra_body 说明
extra_body 是与请求体平级的 JSON 字段,用于传递 Gemini 原生的生成配置。image_config 支持的参数:
传入的
image_size 不能超过模型支持的上限,否则 API 会返回错误或自动降级。cURL 示例
纯图片输出
如果只需要生成图片、不需要文字回复,可以在extra_body 中额外指定 response_modalities:
Chat Completions 模式下,生成的图片会以 Markdown 内联图片格式
 嵌入在响应的 choices[].message.content 中。方式二:Gemini 原生 API
直接使用 Gemini 的generateContent 接口:
请求参数
cURL 示例
响应格式
Gemini 原生接口返回的图片在candidates[].content.parts[].inlineData 中:
尺寸与宽高比对照
也可以直接传比例值,如
"3:2"、"16:9" 等。
模型选择建议
Gemini 图片生成模型都具备文字渲染能力,适合需要在图片中生成清晰文字的场合。同时支持多轮对话修改图片——在同一次会话中继续发送消息即可对前一张图进行调整。