Opprett en melding
Kall Claude via CometAPI Messages-endepunktet med tekst- og bildeinndata, adaptiv tenkning, Prompt-caching, Streaming og verktøy.
POST /v1/messages til å sende Claude-forespørsler i Anthropic Messages-formatet.
Eksemplene konfigurerer den offisielle Anthropic SDK-en med CometAPI-base-URL-en og
leser API-nøkkelen din fra $COMETAPI_KEY.
x-api-key eller Authorization: Bearer. Anthropic SDK-en bruker
x-api-key. HTTP-eksemplene inkluderer anthropic-version: 2023-06-01.Hurtigstart
Eksemplene nedenfor ber om tre søkespørringer. Angi$COMETAPI_KEY før
du kjører dem. Installer anthropic for Python eller @anthropic-ai/sdk for JavaScript:
content-array. Les blokker der type er text;
blokker for tenkning og verktøy kan vises før teksten.
Kontroller adaptiv tenkning
Settthinking.type til adaptive, og velg en output_config.effort-verdi.
Følgende eksempel bruker xhigh og leser den fullførte meldingen fra en strøm:
max_tokens. La det være plass til det endelige
svaret samt tenkning. Et svar kan inneholde tekst uten en synlig
tenkningsblokk. Behold eventuelle returnerte tenkningsblokker uendret i samtale
historikken.
Se
Thinking.
Eksemplene utelater temperature, top_p og top_k; se dokumentasjonen for den valgte
modellens parametere før du legger til samplingkontroller.
Mellomlagre Prompt-er
Plasser et cache-breakpoint på referansemateriale som du gjenbruker mellom forespørsler. Lagre referansematerialet ditt i en UTF-8-reference.txt-fil før du kjører dette
eksempelet. Bruk et prefiks som oppfyller den valgte modellens
minste mellomlagringsbare lengde:
cache_creation_input_tokensteller tokens som skrives til cachen.cache_read_input_tokensteller tokens som leses fra cachen.input_tokensteller inndata som behandles utenfor disse cache-tellerne.
cache_read_input_tokens hvor mange input tokens
som ble lest fra cachen. OpenAPI- Prompt Cache
-eksempelet inneholder en komplett fiktiv referanse som du kan lagre som
reference.txt for å prøve eksempelet.
Strøm svar
Angistream: true for Server-Sent Events. SDK-en eksponerer tekstfragmenter etter hvert som de
ankommer:
message_start, innholdsblokkhendelser, message_delta,
og message_stop. Innholdsblokker kan inneholde tekst, tenkning eller verktøyaktivitet.
For en tekstblokk inneholder content_block_delta en text_delta. Les endelige bruksdata
og stoppårsaken fra message_delta.
Kontroller innsats
Angioutput_config.effort for å styre mengden resonnering. Dette eksemplet bruker
low for en kort forklaring og venter på den fullførte strømmede meldingen:
max_tokens separat for å begrense utdataenes lengde.
Bruk serververktøy
Serververktøy kjøres under API-forespørselen og returnerer resultatblokker sammen med Claudes svar.- Web Fetch
- Web Search
web_fetch_tool_result blokken:server_tool_use-blokk med en web_fetch_tool_result
som inneholder det hentede dokumentet eller en verktøyfeil.Returner resultater fra klientverktøy
For et klientverktøy returnerer Claude entool_use-blokk. Kjør applikasjonsfunksjonen
og send resultatet i en tool_result-blokk med den samsvarende tool_use_id.
Behold alt assistentinnholdet mellom de to forespørslene.
Dette eksemplet oppgir et fiktivt bestillingsresultat og ber Claude bruke dette resultatet:
Svareksempel
En forespørsel uten strømming returnerer et meldingsobjekt. Følgende eksempel viser dets tekst- og bruksfelt med en illustrativ meldingsidentifikator:end_turn fullfører svaret,
max_tokens betyr at utdataene nådde grensen, og tool_use ber om et klientverktøy
resultat. For en serververktøyrunde som returnerer pause_turn, fortsett med det
returnerte assistentinnholdet uendret.Autorisasjoner
Your CometAPI key passed via the x-api-key header. Authorization: Bearer $COMETAPI_KEY is also supported.
Overskrifter
The Anthropic API version to use. Defaults to 2023-06-01.
"2023-06-01"
Comma-separated feature identifiers required by a specific beta API feature. Omit this header for the examples on this page.
Kropp
The Claude model to use. See the Models page for available Claude model IDs.
"claude-opus-5"
Conversation history. Use user and assistant messages with text strings or content-block arrays. Return complete assistant content blocks when continuing a tool call.
The maximum number of tokens to generate. The model may stop before reaching this limit. When using thinking, the thinking tokens count towards this limit.
x >= 11024
System prompt providing context and instructions to Claude. Can be a plain string or an array of content blocks (useful for prompt caching).
Sampling temperature. The examples omit sampling overrides.
0 <= x <= 1Nucleus sampling threshold. The examples omit sampling overrides.
0 <= x <= 1Limits sampling to the k most likely tokens. The examples omit sampling overrides.
x >= 0If true, stream the response incrementally using Server-Sent Events (SSE). Events include message_start, content_block_start, content_block_delta, content_block_stop, message_delta, and message_stop.
Custom strings that cause the model to stop generating when encountered. The stop sequence is not included in the response.
Thinking configuration. The adaptive example uses type adaptive and sets output_config.effort separately.
Client tools define a name and input_schema. Server tools use a versioned type and name, such as the web_fetch and web_search examples on this page.
Controls how the model uses tools.
Request metadata for tracking and analytics.
Configuration for reasoning effort and structured output.
The service tier to use. auto tries priority capacity first, standard_only uses only standard capacity.
auto, standard_only Svar
Successful response. When stream is true, the response is a stream of SSE events.
Message identifier returned by the API.
Always message.
message Always assistant.
assistant The response content blocks. May include text, thinking, tool_use, and other block types.
Model ID reported by the response.
Why the model stopped generating. refusal can be returned as a successful HTTP response when the model declines a request.
end_turn, max_tokens, stop_sequence, tool_use, pause_turn, refusal The stop sequence that caused the model to stop, if applicable.
Token usage statistics.