Ansökningsprocess
För att använda Claude Messages API, börja med att gå till Ace Data Cloud-konsolen för att hämta din API-token, som du ska spara för framtida bruk.
Om du inte har loggat in eller registrerat dig kommer du automatiskt att omdirigeras till inloggningssidan där du uppmanas att registrera dig och logga in. När detta är klart kommer du automatiskt att återvända till den aktuella sidan.
En API-token räcker för att anropa alla plattformens tjänster, det behövs ingen separat ansökan för varje tjänst. Första ansökan ger en gratis kvot för att prova; om kvoten tar slut kan du ladda på allmän balans i konsolen.
📘 Fullständig dokumentation: Claude Messages API →
Grundläggande Användning
Begärningsvägen för Claude Messages API är/v1/messages, vilket är i linje med Anthropics officiella API. Vi behöver minst tillhandahålla tre obligatoriska parametrar:
model: Välj vilken Claude-modell som ska användas. Den senaste flaggskeppsmodellen ärclaude-fable-5-1(1 miljon token kontext, max utdata 128K token); den ursprungligaclaude-fable-5är fortfarande kompatibel och kvar.messages: Inmatningsmeddelandearray, där varje meddelande innehållerrole(roll) ochcontent(innehåll), därrolestöderuserochassistant.max_tokens: Max antal utdata-token, som används för att begränsa längden på ett enstaka svar.
system: Systemprompt, som används för att ställa in modellens beteende och roll.temperature: Genereringsslumptal, mellan 0-1, ju högre värde desto mer spridda svar.stream: Om strömmande svar ska användas, sätt tilltrueför att uppnå tecken-för-tecken återgivning.stop_sequences: Anpassade stoppsekvenser, modellen slutar generera när den stöter på dessa texter.top_p: Kärnprovningsparameter, som tillsammans med temperature kontrollerar den genererade slumpmässigheten.top_k: Prover endast från de K mest sannolika alternativen.tools: Verktygsdefinition, som gör att modellen kan anropa externa funktioner.tool_choice: Kontrollerar hur modellen använder de tillhandahållna verktygen.cache_control: Skapar automatiskt en cache-punkt vid den sista cachade innehållsblocken i begäran; kan också skrivas på specifika innehållsblock.
cURL Exempel
Python Exempel
id: Den unika identifieraren för detta meddelande.type: Alltidmessage.role: Alltidassistant.content: Svarsinnehållsarray, där varje element innehållertype(somtext) och motsvarande innehåll.model: Namnet på modellen som hanterar begäran.stop_reason: Anledningen till att det stoppades. Stabilt värde inkluderarend_turn,max_tokens,stop_sequence,tool_use,pause_turn(kan återge nuvarande assistant-innehåll oförändrat för att fortsätta),refusalochmodel_context_window_exceeded.stop_sequence: Om det stoppades på grund av anpassad stoppsekvens, visas den matchande stoppsekvensens text.stop_details: Närstop_reasonärrefusal, kan det innehålla avvisningskategori och förklaring.usage: Token-användningsstatistik.input_tokensär icke-cachad inmatning;cache_creation_input_tokensochcache_read_input_tokensär respektive cache-skrivning och läsning;output_tokensär antalet utdata-token. Fable 5.1:s officiella cache-läsningsbaspris är 12.50 och $20/miljon token; plattformens faktiska priser beräknas enligt paketrabatter. Icke-strömmande svar kan också innehållacostregistrerat av Ace Data Cloud.
Systemprompt
Claude Messages API stöder att ställa in systemprompt genomsystem-fältet, vilket används för att definiera modellens beteende, roll och kontext.
Python Exempel
system-prompten kan man exakt kontrollera Claudes roll och beteende.
Strömmande Svar
Detta gränssnitt stöder också strömmande svar, sättstream-parametern till true för att få en stegvis återgivningseffekt, vilket är mycket lämpligt för att implementera tecken-för-tecken visning på en webbsida.
Python Exempel
event: och data:. Strömmande händelsetyper inkluderar:
message_start: Meddelande börjar, innehåller grundläggande information om meddelandet och modellnamnet.content_block_start: Innehållsblock börjar.content_block_delta: Innehållsblockens inkrementella uppdatering, innehåller nygenererade textstycken.content_block_stop: Innehållsblock slutar.message_delta: Meddelande-nivåns inkrementella uppdatering, innehållerstop_reasonoch slutligusageinformation.message_stop: Meddelande slutar.
content_block_delta händelser som innehåller stegvis genererat textinnehåll, genom att sammanfoga alla text_delta kan man få den fullständiga svaret.
JavaScript Exempel
Flera rundor av dialog
Om du vill ansluta till flera rundor av dialogfunktioner, behöver du växla mellanuser och assistant roller i messages arrayen och inkludera tidigare dialoghistorik.
Python Exempel
messages, kan Claude kombinera kontexten för att ge exakta svar.
Djup tänkande modell
Claudes tänkande och tänkande sammanfattning är två olika koncept: modellen kan utföra intern resonemang, men API:et returnerar inte den ursprungliga tankekedjan. När resonemangsprocessen behöver visas, returnerar API:et en bearbetad sammanfattning. Den aktuella modellen rekommenderar att använda adaptivt tänkande och kontrollera den totala resonemangsinsatsen genomoutput_config.effort:
display: "summarized"returnerar en läsbar sammanfattning av tankarna; det är inte den ursprungliga tankekedjan.display: "omitted"returnerarthinking: "", men behåller fortfarande den oklarasignatureför att stödja efterföljande dialog.- Fable 5.1, Fable 5, Opus 5, Sonnet 5, Opus 4.8 och Opus 4.7 har som standard
omittedför display; Opus 4.6, Sonnet 4.6 och tidigare modeller som stöder tänkande använder som standardsummarized. - Display påverkar endast det returnerade innehållet och strömmande fördröjning, stänger inte av resonemanget och minskar inte kostnaden för tänkande tokens.
- Huruvida tänkande är som standard aktiverat och standardvärdet för display är två oberoende frågor. Opus 5, Sonnet 5 är som standard aktiverat för adaptivt tänkande; Opus 4.8, 4.7 och 4.6 måste aktiveras uttryckligen.
budget_tokensanvänds endast för äldre modeller som fortfarande stöder fast tänkande budget. Nya modeller bör användathinking.type=adaptiveochoutput_config.effort; Fable 5.1:s tänkande är alltid aktiverat och kan inte stängas av uttryckligen.- Vid flera rundor av dialog och verktygsanrop bör den fullständiga tänkande blocket och signaturen som returneras av assistenten skickas tillbaka oförändrat; ändra inte eller generera signaturen själv.
- Vissa kompatibla rutter kan inte hantera
redacted_thinkingeller stänga av tänkande utan förlust, i sådana fall returneras parameterfel och tyst inte tas bort eller ändrar begärans semantik.
summarized att producera thinking_delta; omitted producerar inte thinking_delta, utan behåller endast livscykeln för tänkande block och signature_delta.
Visuell modell
Använda URL-bilder
cURL-exempel
image/jpeg, image/png, image/gif, image/webp.
Dokument och PDF
PDF använderdocument innehållsblock och stöder både Base64 och URL som stabila källor. Base64-källan måste använda application/pdf:
{"type":"url","url":"https://example.com/report.pdf"}. document stöder också text/plain och content källor som består av text/bild block; valfria fält inkluderar title, context och citations. Files API:s file_id källa tillhör en oberoende beta-funktion och ingår inte i detta gränssnitts stabila avtal.
Cache för förslag
Övergripandecache_control kommer automatiskt att placera cache-punkten på det sista cachade blocket:
cache_control på text-, bild-, dokument-, tool_use-, tool_result innehållsblock eller verktygsdefinitioner. ttl stöder 5m (standard) och 1h; kontrollera cache-skrivning och träffar med usage.cache_creation_input_tokens och usage.cache_read_input_tokens.
Exempel på returresultat:
Verktygsanrop (Tool Use)
Claude Messages API stöder inbyggt verktygsanrop, vilket tillåter modellen att anropa dina fördefinierade verktyg/funktioner vid behov.Python-exempel
content med en typ av tool_use innehållsblock:
stop_reason är tool_use, vilket indikerar att modellen behöver anropa ett verktyg. När du får detta resultat måste du utföra verktygsfunktionen och återföra resultatet i form av tool_result till modellen:
Skillnader mellan Chat Completion API
Ace Data Cloud erbjuder två format för Claude API, de huvudsakliga skillnaderna är som följer: Messages API:susage.input_tokens representerar endast icke-cachad indata, cache_read_input_tokens och cache_creation_input_tokens är oberoende faktureringskategorier; de tre kommer att beräknas enligt motsvarande priser.
Om ditt system redan är integrerat med OpenAI-formatet kan du använda Chat Completion API för en sömlös övergång. Om du behöver använda Claudes fulla inhemska kapacitet rekommenderas det att använda Messages API.
Felhantering
Felresponsen från den offentliga API:n använder Ace Data Cloud-plattformens envelope:error.code är en stabil felkod, error.message är en beskrivning, trace_id används för att spåra begäran. Vanliga HTTP-statusar inkluderar:
400: Begärningsparametrar eller protokollinnehåll är ogiltiga.401: Auktoriseringstoken är ogiltig, saknas eller har gått ut.403: Åtkomst förbjuden, otillräcklig balans eller begränsad kvot.404: API eller modell finns inte.413: Begärningskropp för stor.429: För många begärningar.500/503/504: Tjänstfel, tillfälligt otillgänglig eller tidsgräns för behandling.
Exempel på felrespons
error.code.

