你將建立的內容
你將透過 CometAPI 呼叫 Gemini 圖像的generateContent 路由,向 Gemini 圖像模型(包括 Nano Banana 模型系列)請求圖像輸出,略過中間的 thought 圖像部分,並儲存最終的 inlineData 圖像。
先決條件
- 已儲存在
COMETAPI_KEY中的 CometAPI API key - Python 3.10+ 與
requests,或 Node.js 18+ - 一個 Gemini 圖像 model ID。維護中的 API 參考使用
gemini-3.1-flash-image-preview作為文字轉圖片範例。
API key、基礎 URL、驗證
透過 CometAPI 使用 Gemini 圖像路由:x-goog-api-key 進行驗證:
程式碼範例
使用下方分頁查看可直接複製的 cURL、Python 與 Node.js 範例。流程說明
Gemini 圖像生成在這個路由上是同步的。回應使用 Gemini 原生的candidates[].content.parts[]。parts 可能包含文字、生成的圖像,以及 thought 為 true 的中間圖像部分。
儲存結果時,請逐一處理圖像 parts、忽略 thought: true,並儲存最後剩下的 inlineData 圖像。
常見參數
疑難排解 / 常見問答
回應中包含 thought 圖像
回應中包含 thought 圖像
不要儲存
thought 為 true 的 parts。這些是中間圖像,不是最終輸出。請求只回傳文字
請求只回傳文字
請檢查
generationConfig.responseModalities 是否包含 IMAGE,以及所選模型是否支援圖像輸出。我需要 image-to-image
我需要 image-to-image
依照 Gemini 圖像指南所示使用
inline_data 請求 parts,並保持最終圖像的解析邏輯不變。後續步驟
- 閱讀 Gemini 圖像 API 參考。
- 在 使用 Gemini 圖像模型 查看更多範例。
- 在 Models 中尋找可用的圖像模型。
- 使用 在呼叫模型前估算請求成本 估算成本。