Co zbudujesz
Wywołasz trasę Gemini imagegenerateContent przez CometAPI, zażądasz wygenerowania obrazu z modeli obrazowych Gemini, w tym rodzin modeli Nano Banana, pominiesz pośrednie części obrazu thought i zapiszesz końcowy obraz inlineData.
Wymagania wstępne
- Klucz API CometAPI zapisany w
COMETAPI_KEY - Python 3.10+ z
requestslub Node.js 18+ - model ID modelu obrazowego Gemini. Utrzymywana dokumentacja referencyjna API używa
gemini-3.1-flash-image-previewjako przykładu text-to-image.
Klucz API, bazowy URL, uwierzytelnianie
Użyj trasy Gemini image przez CometAPI:x-goog-api-key:
Przykłady kodu
Skorzystaj z poniższych zakładek, aby skopiować przykłady w cURL, Python i Node.js.Wyjaśnienie działania
Generowanie obrazów Gemini jest synchroniczne na tej trasie. Odpowiedź używa natywnego formatu Geminicandidates[].content.parts[]. Części mogą zawierać tekst, wygenerowane obrazy i pośrednie części obrazu, gdzie thought ma wartość true.
Podczas zapisywania wyniku przejdź przez części obrazu, zignoruj thought: true i zapisz ostatni pozostały obraz inlineData.
Typowe parametry
Rozwiązywanie problemów / FAQ
Odpowiedź zawiera obrazy thought
Odpowiedź zawiera obrazy thought
Nie zapisuj części, w których
thought ma wartość true. To obrazy pośrednie, a nie końcowy wynik.Żądanie zwraca tylko tekst
Żądanie zwraca tylko tekst
Sprawdź, czy
generationConfig.responseModalities zawiera IMAGE oraz czy wybrany model obsługuje wyjście obrazowe.Potrzebuję image-to-image
Potrzebuję image-to-image
Użyj części żądania
inline_data, jak pokazano w przewodniku Gemini image, i pozostaw tę samą logikę parsowania końcowego obrazu.Następne kroki
- Przeczytaj dokumentację referencyjną Gemini image API.
- Zobacz więcej przykładów w Use Gemini image models.
- Znajdź dostępne modele obrazowe w Models.
- Oszacuj koszt za pomocą Estimate request cost before calling a model.