Content genereren
Gebruik het native API-formaat van Gemini via CometAPI voor tekstgeneratie, multimodale input, redeneren, function calling, Google Search-grounding, JSON-modus en Streaming.
x-goog-api-key als Authorization: Bearer-headers worden ondersteund voor authenticatie.Snelstart
Om een Gemini SDK of HTTP-client met CometAPI te gebruiken, vervang je de base URL en API-sleutel:| Instelling | Standaard van Google | CometAPI |
|---|---|---|
| Base URL | generativelanguage.googleapis.com | api.cometapi.com |
| API-sleutel | $GEMINI_API_KEY | $COMETAPI_KEY |
Video-invoer verzenden
GeminigenerateContent accepteert video als een content-onderdeel. Kies de invoervorm op basis van waar de video is opgeslagen:
| Videobron | Request-onderdeel | Gebruik wanneer |
|---|---|---|
| Lokaal videobestand | inlineData | De video klein genoeg is om als base64 in de JSON-request mee te sturen. |
| Openbare video-URL | fileData.fileUri | De video beschikbaar is via een openbare HTTPS-URL die geen authenticatie vereist. |
inlineData.mimeType en fileData.fileUri. Verstuur URL-media niet als file_data.file_uri.fileData.fileUri:
generateContent-request zelf met inlineData of fileData.fileUri.
Denken configureren (reasoning)
Gemini-modellen kunnen interne redenering uitvoeren voordat ze een antwoord genereren. De besturingsmethode hangt af van de modelgeneratie.- Gemini 3 (thinkingLevel)
- Gemini 2.5 (thinkingBudget)
thinkingLevel om de diepte van de redenering te regelen. Beschikbare niveaus: MINIMAL, LOW, MEDIUM, HIGH.Gebruik gemini-3-flash-preview als het standaard voorbeeldmodel, tenzij je specifiek een andere Gemini 3-variant nodig hebt.Responses streamen
Om Server-Sent Events te ontvangen terwijl het model content genereert, gebruik jestreamGenerateContent?alt=sse als operator. Elk SSE-event bevat een data:-regel met een JSON GenerateContentResponse-object.
System instructions instellen
Om het gedrag van het model gedurende het hele gesprek te sturen, gebruik jesystemInstruction:
JSON-output aanvragen
Om gestructureerde JSON-output af te dwingen, stel jeresponseMimeType in. Optioneel kun je een responseSchema opgeven voor strikte schemavalidatie:
Grounding met Google Search
Om realtime zoeken op het web in te schakelen, voeg je eengoogleSearch-tool toe:
groundingMetadata met bron-URL’s en betrouwbaarheidsscores.
Response example
Een typische response van het Gemini-endpoint van CometAPI:thoughtsTokenCount in usageMetadata laat zien hoeveel tokens het model heeft besteed aan interne redenering, zelfs wanneer denkoutput niet in de response is opgenomen.Vergelijk met OpenAI-compatible endpoint
| Functie | Gemini Native (/v1beta/models/...) | OpenAI-Compatible (/v1/chat/completions) |
|---|---|---|
| Thinking-controle | thinkingConfig met thinkingLevel / thinkingBudget | Niet beschikbaar |
| Google Search-grounding | tools: [\{"google_search": \{\}\}] | Niet beschikbaar |
| Google Maps-grounding | tools: [\{"googleMaps": \{\}\}] | Niet beschikbaar |
| Modality voor afbeeldinggeneratie | responseModalities: ["IMAGE"] | Niet beschikbaar |
| Auth-header | x-goog-api-key of Bearer | Alleen Bearer |
| Response-formaat | Gemini-native (candidates, parts) | OpenAI-formaat (choices, message) |
Autorisaties
Your CometAPI key passed via the x-goog-api-key header. Bearer token authentication (Authorization: Bearer $COMETAPI_KEY) is also supported.
Padparameters
Gemini model ID. Example: gemini-3-flash-preview, gemini-2.5-pro. See the Models page for current options.
The operation to perform. Use generateContent for synchronous responses, or streamGenerateContent?alt=sse for Server-Sent Events streaming.
generateContent, streamGenerateContent?alt=sse Body
Conversation content. Each entry has an optional role (user or model) and a parts array.
System instructions that guide the model's behavior across the entire conversation. Text only.
Tools the model may use to generate responses. Supports function declarations, Google Search, Google Maps, and code execution.
Configuration for tool usage, such as function calling mode.
Safety filter settings. Override default thresholds for specific harm categories.
Configuration for model generation behavior including temperature, output length, and response format.
The name of cached content to use as context. Format: cachedContents/{id}. See the Gemini context caching documentation for details.
Respons
Successful response. For streaming requests, the response is a stream of SSE events, each containing a GenerateContentResponse JSON object prefixed with data:.
The generated response candidates.
Feedback on the prompt, including safety blocking information.
Token usage statistics for the request.
The model version that generated this response.
The timestamp when this response was created (ISO 8601 format).
Unique identifier for this response.