Skip to main content
POST
Usa el formato de solicitud nativo de Gemini a través de CometAPI para generar texto, enviar entrada de video y configurar razonamiento o herramientas. Los ejemplos usan gemini-3.8-flash.
Consulta la referencia de la API GenerateContent para ver las definiciones de campos y las opciones específicas de cada modelo. Esta página muestra la URL base de CometAPI, la autenticación y ejemplos de solicitudes.
Se admiten los encabezados x-goog-api-key y Authorization: Bearer para la autenticación.

Inicio rápido

Para usar el SDK de Google Gen AI o un cliente HTTP con CometAPI, configura la URL base y la clave de API: Usa la guía de generación de texto de GenerateContent para ver ejemplos de la API nativa. Conserva la estructura de solicitud generateContent al cambiar la URL base.

Enviar entrada de video

Envía el video como una parte de contenido. Elige la estructura de entrada según dónde esté almacenado el video:
Para las solicitudes REST y curl, usa nombres de campos camelCase como inlineData.mimeType y fileData.fileUri.
Este ejemplo envía datos MP4 en línea. Reemplaza <base64-encoded-mp4> por el contenido base64 de tu video:
Este ejemplo analiza un MP4 público de una flor que se abre:

Configurar el pensamiento (razonamiento)

Use thinkingConfig.thinkingLevel para guiar la profundidad del razonamiento. Los ejemplos siguientes usan LOW y MEDIUM.
Este ejemplo establece el nivel de pensamiento en LOW:
thinkingBudget es un control numérico para modelos compatibles, incluido Gemini 2.5. Use thinkingLevel en los ejemplos de Gemini 3 y no envíe ambos controles. Consulte la guía de Google sobre razonamiento para conocer los valores específicos de cada modelo.

Transmitir respuestas

Use streamGenerateContent?alt=sse para recibir Server-Sent Events. Cada línea data: contiene un objeto JSON GenerateContentResponse:

Establecer instrucciones del sistema

Use systemInstruction para guiar la respuesta. Este ejemplo solicita una ecuación sin texto adicional:

Solicitar salida JSON

Establezca responseMimeType en application/json y proporcione un responseSchema. Este ejemplo solicita una matriz de planetas con nombres y distancias numéricas:
Agrega una herramienta googleSearch para solicitar grounding de búsqueda. Este ejemplo solicita el resultado de la final de la UEFA EURO 2024:
Cuando se usa la búsqueda, inspecciona los groundingMetadata del candidato para ver las consultas de búsqueda, las URL de las fuentes y los vínculos entre las fuentes y el texto de respuesta.

Conserva el contenido de la conversación

Para conversaciones de varios turnos, envía el contenido precedente de user y model en contents. Los ejemplos de chat del SDK mantienen este historial por ti. Para las llamadas a funciones, devuelve un functionResponse por cada functionCall, con el name correspondiente y cualquier id devuelto. Vuelve a փոխանցar el contenido precedente del modelo sin cambios, incluidos los campos thoughtSignature. La firma es opaca; no la reconstruyas a partir del texto mostrado.

Ejemplo de respuesta

Una respuesta de texto incluye contenido generado y uso de Tokens. Este ejemplo abreviado omite campos opcionales:
thoughtsTokenCount informa sobre Tokens de razonamiento internos, incluso cuando la respuesta no incluye un resumen de razonamiento. Inspecciona cada parte del contenido; una respuesta puede contener texto, resúmenes o llamadas a funciones.

Compara los formatos de solicitud

Elige el endpoint nativo para los campos de solicitud y respuesta de Gemini. Consulta Chat Completions para conocer el formato compatible con OpenAI.

Autorizaciones

x-goog-api-key
string
header
requerido

Your CometAPI key passed via the x-goog-api-key header. Bearer token authentication (Authorization: Bearer $COMETAPI_KEY) is also supported.

Parámetros de ruta

model
string
predeterminado:gemini-3.8-flash
requerido

Gemini model ID. These examples use gemini-3.8-flash. See the Models page for available model IDs.

operator
enum<string>
predeterminado:generateContent
requerido

Operation to perform. Use generateContent for a JSON response. For Server-Sent Events, select streamGenerateContent and set the separate alt query parameter to sse.

Opciones disponibles:
generateContent,
streamGenerateContent

Parámetros de consulta

alt
enum<string>

Set to sse when the operator is streamGenerateContent. Omit this parameter for generateContent.

Opciones disponibles:
sse

Cuerpo

application/json
contents
object[]

Conversation content. Each entry has an optional role (user or model) and a parts array. For tool results, preserve the complete preceding model content, including any thoughtSignature fields.

systemInstruction
object

System instructions that guide the model's behavior across the entire conversation. Text only.

tools
object[]

Tools available to the model during generation. Use googleSearch for search grounding.

toolConfig
object

Configuration for tool usage, such as function calling mode.

safetySettings
object[]

Safety filter settings. Override default thresholds for specific harm categories.

generationConfig
object

Configuration for model generation behavior including temperature, output length, and response format.

cachedContent
string

The name of cached content to use as context. Format: cachedContents/{id}. See the Gemini context caching documentation for details.

Respuesta

200 - application/json

Successful response. For streaming requests, the response is a stream of SSE events, each containing a GenerateContentResponse JSON object prefixed with data:.

candidates
object[]

The generated response candidates.

promptFeedback
object

Feedback on the prompt, including safety blocking information.

usageMetadata
object

Token usage statistics for the request.

modelVersion
string

The model version that generated this response.

createTime
string

The timestamp when this response was created (ISO 8601 format).

responseId
string

Unique identifier for this response.

Última modificación el 8 de septiembre de 2026