Skip to main content

Co zbudujesz

Wywołasz trasę Gemini image generateContent przez CometAPI, zażądasz wygenerowania obrazu z modeli obrazowych Gemini, w tym rodzin modeli Nano Banana, pominiesz pośrednie części obrazu thought i zapiszesz końcowy obraz inlineData.

Wymagania wstępne

  • Klucz API CometAPI zapisany w COMETAPI_KEY
  • Python 3.10+ z requests lub Node.js 18+
  • model ID modelu obrazowego Gemini. Utrzymywana dokumentacja referencyjna API używa gemini-3.1-flash-image-preview jako przykładu text-to-image.

Klucz API, bazowy URL, uwierzytelnianie

Użyj trasy Gemini image przez CometAPI:
Uwierzytelnij się za pomocą x-goog-api-key:

Przykłady kodu

Skorzystaj z poniższych zakładek, aby skopiować przykłady w cURL, Python i Node.js.

Wyjaśnienie działania

Generowanie obrazów Gemini jest synchroniczne na tej trasie. Odpowiedź używa natywnego formatu Gemini candidates[].content.parts[]. Części mogą zawierać tekst, wygenerowane obrazy i pośrednie części obrazu, gdzie thought ma wartość true. Podczas zapisywania wyniku przejdź przez części obrazu, zignoruj thought: true i zapisz ostatni pozostały obraz inlineData.

Typowe parametry

Rozwiązywanie problemów / FAQ

Nie zapisuj części, w których thought ma wartość true. To obrazy pośrednie, a nie końcowy wynik.
Sprawdź, czy generationConfig.responseModalities zawiera IMAGE oraz czy wybrany model obsługuje wyjście obrazowe.
Użyj części żądania inline_data, jak pokazano w przewodniku Gemini image, i pozostaw tę samą logikę parsowania końcowego obrazu.

Następne kroki