Skip to main content

你将构建的内容

你将通过 CometAPI 调用 Gemini 图像的 generateContent 路由,请求 Gemini 图像模型(包括 Nano Banana 模型家族)输出图像,跳过中间的 thought 图像部分,并保存最终的 inlineData 图像。

前置条件

  • 一个存储在 COMETAPI_KEY 中的 CometAPI API key
  • 安装了 requests 的 Python 3.10+,或 Node.js 18+
  • 一个 Gemini 图像 model ID。维护中的 API 参考使用 gemini-3.1-flash-image-preview 作为文生图示例。

API key、基础 URL、身份验证

通过 CometAPI 使用 Gemini 图像路由:
使用 x-goog-api-key 进行身份验证:

代码示例

使用下面的标签页查看可直接复制的 cURL、Python 和 Node.js 示例。

流程说明

该路由上的 Gemini 图像生成是同步的。响应使用 Gemini 原生 candidates[].content.parts[]。parts 中可以包含文本、生成的图像,以及 thoughttrue 的中间图像部分。 保存结果时,遍历图像 parts,忽略 thought: true,并保存最后一个剩余的 inlineData 图像。

常见参数

故障排查 / 常见问题

不要保存 thoughttrue 的 parts。这些是中间图像,不是最终输出。
检查 generationConfig.responseModalities 是否包含 IMAGE,并确认所选模型支持图像输出。
按照 Gemini 图像指南中的说明使用 inline_data 请求 parts,并保持最终图像解析逻辑不变。

后续步骤