Gerar conteúdo
Use o formato de API nativa do Gemini por meio da CometAPI para geração de texto, entrada multimodal, reasoning, function calling, grounding com Google Search, modo JSON e streaming.
x-goog-api-key quanto Authorization: Bearer são compatíveis para autenticação.Início rápido
Para usar qualquer SDK do Gemini ou cliente HTTP com a CometAPI, substitua a URL base e a chave de API:Enviar entrada de vídeo
OgenerateContent do Gemini aceita vídeo como uma parte do conteúdo. Escolha o formato de entrada com base em onde o vídeo está armazenado:
inlineData.mimeType e fileData.fileUri. Não envie mídia por URL como file_data.file_uri.fileData.fileUri:
generateContent com inlineData ou fileData.fileUri.
Configurar thinking (reasoning)
Os modelos Gemini podem realizar raciocínio interno antes de gerar uma resposta. O método de controle depende da geração do modelo.- Gemini 3 (thinkingLevel)
- Gemini 2.5 (thinkingBudget)
thinkingLevel para controlar a profundidade do raciocínio. Níveis disponíveis: MINIMAL, LOW, MEDIUM, HIGH.Use gemini-3-flash-preview como model de exemplo padrão, a menos que você precise especificamente de uma variante diferente do Gemini 3.Transmitir Responses
Para receber Server-Sent Events à medida que o modelo gera conteúdo, usestreamGenerateContent?alt=sse como operador. Cada evento SSE contém uma linha data: com um objeto JSON GenerateContentResponse.
Definir instruções do sistema
Para orientar o comportamento do modelo ao longo de toda a conversa, usesystemInstruction:
Solicitar saída JSON
Para forçar uma saída JSON estruturada, definaresponseMimeType. Opcionalmente, forneça um responseSchema para validação rigorosa do schema:
Ground com Google Search
Para ativar a pesquisa na web em tempo real, adicione uma ferramentagoogleSearch:
groundingMetadata com URLs de origem e pontuações de confiança.
Exemplo de resposta
Uma resposta típica do endpoint Gemini da CometAPI:thoughtsTokenCount em usageMetadata mostra quantos Tokens o modelo gastou em raciocínio interno, mesmo quando a saída de pensamento não está incluída na resposta.Compare com o endpoint compatível com OpenAI
Autorizações
Your CometAPI key passed via the x-goog-api-key header. Bearer token authentication (Authorization: Bearer $COMETAPI_KEY) is also supported.
Parâmetros de caminho
Gemini model ID. Example: gemini-3-flash-preview, gemini-2.5-pro. See the Models page for current options.
The operation to perform. Use generateContent for synchronous responses, or streamGenerateContent?alt=sse for Server-Sent Events streaming.
generateContent, streamGenerateContent?alt=sse Corpo
Conversation content. Each entry has an optional role (user or model) and a parts array.
System instructions that guide the model's behavior across the entire conversation. Text only.
Tools the model may use to generate responses. Supports function declarations, Google Search, Google Maps, and code execution.
Configuration for tool usage, such as function calling mode.
Safety filter settings. Override default thresholds for specific harm categories.
Configuration for model generation behavior including temperature, output length, and response format.
The name of cached content to use as context. Format: cachedContents/{id}. See the Gemini context caching documentation for details.
Resposta
Successful response. For streaming requests, the response is a stream of SSE events, each containing a GenerateContentResponse JSON object prefixed with data: .
The generated response candidates.
Feedback on the prompt, including safety blocking information.
Token usage statistics for the request.
The model version that generated this response.
The timestamp when this response was created (ISO 8601 format).
Unique identifier for this response.