Skip to main content

可用模型

SeeOneAPI 提供以下 Gemini 图片生成模型: 模型都按 Token 用量计费,具体单价以 模型广场 为准。

调用方式

Gemini 图片生成模型不是传统的 Images API/v1/images/generations),而是具备图片输出能力的对话模型。支持两种调用方式:

方式一:Chat Completions API(推荐)

使用 OpenAI 兼容的 Chat Completions 接口,通过 extra_body 传递 Gemini 原生图片配置:

请求参数

extra_body 说明

extra_body 是与请求体平级的 JSON 字段,用于传递 Gemini 原生的生成配置。image_config 支持的参数:
传入的 image_size 不能超过模型支持的上限,否则 API 会返回错误或自动降级。

cURL 示例

纯图片输出

如果只需要生成图片、不需要文字回复,可以在 extra_body 中额外指定 response_modalities
Chat Completions 模式下,生成的图片会以 Markdown 内联图片格式 ![image](data:image/png;base64,...) 嵌入在响应的 choices[].message.content 中。

方式二:Gemini 原生 API

直接使用 Gemini 的 generateContent 接口:

请求参数

cURL 示例

响应格式

Gemini 原生接口返回的图片在 candidates[].content.parts[].inlineData 中:

尺寸与宽高比对照

也可以直接传比例值,如 "3:2""16:9" 等。

模型选择建议

Gemini 图片生成模型都具备文字渲染能力,适合需要在图片中生成清晰文字的场合。同时支持多轮对话修改图片——在同一次会话中继续发送消息即可对前一张图进行调整。