Skip to main content

你將建立的內容

你將透過 CometAPI 呼叫 Gemini 圖像的 generateContent 路由,向 Gemini 圖像模型(包括 Nano Banana 模型系列)請求圖像輸出,略過中間的 thought 圖像部分,並儲存最終的 inlineData 圖像。

先決條件

  • 已儲存在 COMETAPI_KEY 中的 CometAPI API key
  • Python 3.10+ 與 requests,或 Node.js 18+
  • 一個 Gemini 圖像 model ID。維護中的 API 參考使用 gemini-3.1-flash-image-preview 作為文字轉圖片範例。

API key、基礎 URL、驗證

透過 CometAPI 使用 Gemini 圖像路由:
使用 x-goog-api-key 進行驗證:

程式碼範例

使用下方分頁查看可直接複製的 cURL、Python 與 Node.js 範例。

流程說明

Gemini 圖像生成在這個路由上是同步的。回應使用 Gemini 原生的 candidates[].content.parts[]。parts 可能包含文字、生成的圖像,以及 thoughttrue 的中間圖像部分。 儲存結果時,請逐一處理圖像 parts、忽略 thought: true,並儲存最後剩下的 inlineData 圖像。

常見參數

疑難排解 / 常見問答

不要儲存 thoughttrue 的 parts。這些是中間圖像,不是最終輸出。
請檢查 generationConfig.responseModalities 是否包含 IMAGE,以及所選模型是否支援圖像輸出。
依照 Gemini 圖像指南所示使用 inline_data 請求 parts,並保持最終圖像的解析邏輯不變。

後續步驟