Генерування контенту
Використовуйте нативний формат API Gemini через CometAPI для генерації тексту, multimodal input, reasoning, function calling, Google Search grounding, JSON mode і streaming.
x-goog-api-key і Authorization: Bearer.Швидкий старт
Щоб використовувати будь-який SDK Gemini або HTTP-клієнт із CometAPI, замініть base URL та API key:Надсилання відео як вхідних даних
GeminigenerateContent приймає відео як частину content. Виберіть формат вхідних даних залежно від того, де зберігається відео:
inlineData.mimeType і fileData.fileUri. Не надсилайте URL-медіа як file_data.file_uri.fileData.fileUri:
generateContent за допомогою inlineData або fileData.fileUri.
Налаштування thinking (reasoning)
Моделі Gemini можуть виконувати внутрішнє міркування перед генеруванням відповіді. Спосіб керування залежить від покоління моделі.- Gemini 3 (thinkingLevel)
- Gemini 2.5 (thinkingBudget)
thinkingLevel для керування глибиною міркування. Доступні рівні: MINIMAL, LOW, MEDIUM, HIGH.Використовуйте gemini-3-flash-preview як модель прикладу за замовчуванням, якщо вам не потрібен інший варіант Gemini 3.Потокові Responses
Щоб отримувати Server-Sent Events у міру того, як модель генерує вміст, використовуйтеstreamGenerateContent?alt=sse як оператор. Кожна SSE-подія містить рядок data: з JSON-об’єктом GenerateContentResponse.
Задання системних інструкцій
Щоб керувати поведінкою моделі протягом усієї розмови, використовуйтеsystemInstruction:
Запит JSON-виводу
Щоб примусово отримати структурований JSON-вивід, задайтеresponseMimeType. За бажанням можна також надати responseSchema для суворої валідації схеми:
Ground за допомогою Google Search
Щоб увімкнути вебпошук у реальному часі, додайте інструментgoogleSearch:
groundingMetadata з URL-адресами джерел і оцінками впевненості.
Приклад відповіді
Типова відповідь від Gemini endpoint у CometAPI:thoughtsTokenCount у usageMetadata показує, скільки token модель витратила на внутрішнє міркування, навіть якщо результат thinking не включено у відповідь.Порівняння з OpenAI-compatible endpoint
Авторизації
Your CometAPI key passed via the x-goog-api-key header. Bearer token authentication (Authorization: Bearer $COMETAPI_KEY) is also supported.
Параметри шляху
Gemini model ID. Example: gemini-3-flash-preview, gemini-2.5-pro. See the Models page for current options.
The operation to perform. Use generateContent for synchronous responses, or streamGenerateContent?alt=sse for Server-Sent Events streaming.
generateContent, streamGenerateContent?alt=sse Тіло
Conversation content. Each entry has an optional role (user or model) and a parts array.
System instructions that guide the model's behavior across the entire conversation. Text only.
Tools the model may use to generate responses. Supports function declarations, Google Search, Google Maps, and code execution.
Configuration for tool usage, such as function calling mode.
Safety filter settings. Override default thresholds for specific harm categories.
Configuration for model generation behavior including temperature, output length, and response format.
The name of cached content to use as context. Format: cachedContents/{id}. See the Gemini context caching documentation for details.
Відповідь
Successful response. For streaming requests, the response is a stream of SSE events, each containing a GenerateContentResponse JSON object prefixed with data:.
The generated response candidates.
Feedback on the prompt, including safety blocking information.
Token usage statistics for the request.
The model version that generated this response.
The timestamp when this response was created (ISO 8601 format).
Unique identifier for this response.