Crea un messaggio
Chiama Claude tramite l’endpoint Messages di CometAPI con input di testo e immagini, thinking adattivo, caching del Prompt, Streaming e strumenti.
POST /v1/messages per inviare richieste a Claude nel formato Anthropic Messages.
Gli esempi configurano l’SDK Anthropic ufficiale con l’URL di base di CometAPI e
leggono la tua chiave API da $COMETAPI_KEY.
x-api-key o Authorization: Bearer. L’SDK Anthropic utilizza
x-api-key. Gli esempi HTTP includono anthropic-version: 2023-06-01.Guida rapida
Gli esempi seguenti richiedono tre query di ricerca. Imposta$COMETAPI_KEY prima di
eseguirli. Installa anthropic per Python o @anthropic-ai/sdk per JavaScript:
content. Leggi i blocchi il cui type è text;
i blocchi di thinking e di strumenti possono comparire prima del testo.
Controllare il thinking adattivo
Impostathinking.type su adaptive e scegli un valore per output_config.effort.
L’esempio seguente usa xhigh e legge il messaggio completato da uno stream:
max_tokens. Lascia spazio anche per la risposta finale e per il
thinking. Una risposta può contenere testo senza un blocco di thinking visibile.
Mantieni invariati nella cronologia della conversazione tutti i blocchi di thinking restituiti
.
Per la configurazione del thinking specifica del modello, consulta
Thinking.
Gli esempi omettono temperature, top_p e top_k; consulta la documentazione dei parametri del
modello selezionato prima di aggiungere controlli di sampling.
Memorizzare nella cache i Prompt
Inserisci un breakpoint della cache nel materiale di riferimento che riutilizzi tra le richieste. Salva il materiale di riferimento in un file UTF-8reference.txt prima di eseguire questo
esempio. Usa un prefisso che soddisfi la
lunghezza minima memorizzabile nella cache:
cache_creation_input_tokensconta i token scritti nella cache.cache_read_input_tokensconta i token letti dalla cache.input_tokensconta l’input elaborato al di fuori di tali contatori della cache.
cache_read_input_tokens riporta quanti token di input
sono stati letti dalla cache. L’esempio OpenAPI Prompt Cache
contiene un riferimento fittizio completo che puoi salvare come
reference.txt per provare l’esempio.
Trasmettere le risposte in streaming
Impostastream: true per Server-Sent Events. L’SDK espone i frammenti di testo man mano che
arrivano:
message_start, eventi dei blocchi di contenuto, message_delta,
e message_stop. I blocchi di contenuto possono contenere testo, ragionamento o attività degli strumenti.
Per un blocco di testo, content_block_delta contiene un text_delta. Leggi l’utilizzo finale
e il motivo di arresto da message_delta.
Controllo dello sforzo
Impostaoutput_config.effort per orientare la quantità di ragionamento. Questo esempio usa
low per una breve spiegazione e attende il messaggio in streaming completato:
max_tokens separatamente per limitare la lunghezza dell’output.
Usa gli strumenti del server
Gli strumenti del server vengono eseguiti durante la richiesta API e restituiscono blocchi di risultato insieme a la risposta di Claude.- Recupero web
- Ricerca web
web_fetch_tool_result blocco:server_tool_use a un web_fetch_tool_result
contenente il documento recuperato o un errore dello strumento.Restituisci i risultati degli strumenti client
Per uno strumento client, Claude restituisce un bloccotool_use. Esegui la funzione della tua applicazione
e inviane il risultato in un blocco tool_result con il valore tool_use_id corrispondente.
Mantieni l’intero contenuto dell’assistant tra le due richieste.
Questo esempio fornisce un risultato di ordine fittizio e chiede a Claude di usare tale risultato:
Esempio di risposta
Una richiesta non-Streaming restituisce un oggetto messaggio. L’esempio seguente mostra i relativi campi text e usage con un identificatore del messaggio illustrativo:end_turn completa la risposta,
max_tokens indica che l’output ha raggiunto il limite e tool_use richiede il risultato di uno strumento client.
Per un turno di uno strumento server che restituisce pause_turn, prosegui con il
contenuto dell’assistant restituito invariato.Autorizzazioni
Your CometAPI key passed via the x-api-key header. Authorization: Bearer $COMETAPI_KEY is also supported.
Intestazioni
The Anthropic API version to use. Defaults to 2023-06-01.
"2023-06-01"
Comma-separated feature identifiers required by a specific beta API feature. Omit this header for the examples on this page.
Corpo
The Claude model to use. See the Models page for available Claude model IDs.
"claude-opus-5"
Conversation history. Use user and assistant messages with text strings or content-block arrays. Return complete assistant content blocks when continuing a tool call.
The maximum number of tokens to generate. The model may stop before reaching this limit. When using thinking, the thinking tokens count towards this limit.
x >= 11024
System prompt providing context and instructions to Claude. Can be a plain string or an array of content blocks (useful for prompt caching).
Sampling temperature. The examples omit sampling overrides.
0 <= x <= 1Nucleus sampling threshold. The examples omit sampling overrides.
0 <= x <= 1Limits sampling to the k most likely tokens. The examples omit sampling overrides.
x >= 0If true, stream the response incrementally using Server-Sent Events (SSE). Events include message_start, content_block_start, content_block_delta, content_block_stop, message_delta, and message_stop.
Custom strings that cause the model to stop generating when encountered. The stop sequence is not included in the response.
Thinking configuration. The adaptive example uses type adaptive and sets output_config.effort separately.
Client tools define a name and input_schema. Server tools use a versioned type and name, such as the web_fetch and web_search examples on this page.
Controls how the model uses tools.
Request metadata for tracking and analytics.
Configuration for reasoning effort and structured output.
The service tier to use. auto tries priority capacity first, standard_only uses only standard capacity.
auto, standard_only Risposta
Successful response. When stream is true, the response is a stream of SSE events.
Message identifier returned by the API.
Always message.
message Always assistant.
assistant The response content blocks. May include text, thinking, tool_use, and other block types.
Model ID reported by the response.
Why the model stopped generating. refusal can be returned as a successful HTTP response when the model declines a request.
end_turn, max_tokens, stop_sequence, tool_use, pause_turn, refusal The stop sequence that caused the model to stop, if applicable.
Token usage statistics.