Skip to main content
Google Gemini är ett mycket kraftfullt AI-konversationssystem som kan generera flytande och naturliga svar på bara några sekunder genom att ange en prompt. Gemini kan erbjuda fantastiskt intelligent assistans och avsevärt öka människors arbetsproduktivitet och kreativitet. Detta dokument beskriver huvudsakligen användningsflödet för Gemini Chat Completion API, vilket gör att vi enkelt kan använda den officiella Gemini-konversationsfunktionen.

Ansökningsprocess

För att använda Gemini Chat Completion API kan du först gå till Gemini Chat Completion API sidan och klicka på “Acquire”-knappen för att få de nödvändiga autentiseringsuppgifterna: Om du inte har loggat in eller registrerat dig kommer du automatiskt att omdirigeras till inloggningssidan där du uppmanas att registrera dig och logga in. Efter att ha loggat in eller registrerat dig kommer du automatiskt att återvända till den aktuella sidan. Vid första ansökan kommer det att finnas en gratis kvot som ges, så att du kan använda API:et gratis.

Grundläggande Användning

Därefter kan du fylla i motsvarande innehåll på gränssnittet, som visas i bilden:

Vid första användningen av detta gränssnitt behöver vi fylla i minst tre fält, ett är authorization, som du enkelt kan välja från rullgardinsmenyn. Den andra parametern är model, där model är den Gemini-modellkategori vi väljer att använda, här har vi huvudsakligen 6 olika modeller, detaljer kan ses i de modeller vi tillhandahåller. Den sista parametern är messages, där messages är en array av våra inmatade frågor, som representerar flera frågor som kan laddas upp samtidigt, där varje fråga innehåller role och content, där role representerar frågeställarens roll, och vi har tre identiteter: user, assistant, system. Den andra content är det specifika innehållet i vår fråga. Samtidigt kan du notera att det finns motsvarande kod för anrop på höger sida, som du kan kopiera och köra direkt, eller så kan du klicka på “Try”-knappen för att testa.

Efter anropet ser vi att resultatet returneras som följer:
Det returnerade resultatet har flera fält, som beskrivs nedan:
  • id, ID för att generera denna konversationsuppgift, används för att unikt identifiera denna konversationsuppgift.
  • model, den valda Gemini-modellen.
  • choices, Gemini:s svarsinformation på frågorna.
  • usage: statistik över token-användning för denna fråge- och svarsinteraktion.
Där choices innehåller Gemini:s svarsinformation, och choices inuti den innehåller den specifika informationen som Gemini svarade med, som visas i bilden.

Vi kan se att content-fältet i choices innehåller det specifika innehållet i Gemini:s svar.

Strömmande Svar

Detta gränssnitt stöder också strömmande svar, vilket är mycket användbart för webbgränssnitt och kan ge en tecken-för-tecken visningseffekt. Om du vill ha strömmande svar kan du ändra stream-parametern i begärningshuvudet till true. Ändringen visas i bilden, men anropskoden behöver göras motsvarande ändringar för att stödja strömmande svar.

När stream ändras till true, kommer API:et att returnera motsvarande JSON-data rad för rad, och på kodnivå behöver vi göra nödvändiga ändringar för att få radresultaten. Python-exempel på anropskod:
Utdataeffekten ser ut som följer:
Kan ses att svaret innehåller många data, där data inuti choices är det senaste svaret, vilket är i linje med det som beskrivits ovan. choices är det nya svaret, och du kan koppla det till ditt system baserat på resultatet. Samtidigt är slutet av den strömmande svaret baserat på innehållet i data, om innehållet är [DONE], indikerar det att den strömmande svaret har avslutats helt. De returnerade data resultaten har flera fält, som beskrivs nedan:
  • id, ID för att generera denna dialoguppgift, används för att unikt identifiera denna dialoguppgift.
  • model, den valda Gemini-modellen.
  • choices, svarsinformation som Gemini ger för frågorna.
JavaScript stöds också, till exempel Node.js strömmande anropskod ser ut så här:
Java-exempel kod:
Andra språk kan skrivas om på liknande sätt, principen är densamma.

Flera rundor av dialog

Om du vill koppla flera rundor av dialogfunktionalitet, behöver du ladda upp flera frågor i messages-fältet, specifika exempel på flera frågor visas nedan:

Python exempel anropskod:
Genom att ladda upp flera frågor kan du enkelt genomföra flera rundor av dialog och få följande svar:
Kan ses, att choices innehåller information som är konsekvent med det grundläggande användningsinnehållet, vilket inkluderar specifikt innehåll från Gemini som svarar på flera dialoger, så att man kan svara på motsvarande frågor baserat på flera dialoginnehåll.

Gemini-3.0 multimodell

Begäran exempel:
Exempelresultat:
Självklart kan du också skicka en videolänk, den specifika ingången är som följer:
Exempelresultat:
Från ovanstående kan vi se att Gemini 3.0-modellen kan stödja multimodal förståelse.

Gemini-3.1 Multimodal Modell

Gemini 3.1 Pro är en uppgraderad version av Gemini 3.0 Pro, med en underliggande modell av gemini-3.1-pro-preview, som också stöder text, bilder, video och andra multimodala ingångar, med starkare resonemang och förståelse. Användningssättet är helt identiskt med Gemini 3.0 Pro, du behöver bara byta model-parametern till gemini-3.1-pro. Exempel på begäran:
Gemini 3.1 Pro stöder också videoförståelse:
Returformatet är detsamma som Gemini 3.0 Pro, se ovanstående avsnitt om Gemini-3.0 multimodala modeller för mer information.

Felhantering

Vid anrop av API:et, om ett fel uppstår, kommer API:et att returnera motsvarande felkod och information. Till exempel:
  • 400 token_mismatched: Felaktig begäran, möjligtvis på grund av saknade eller ogiltiga parametrar.
  • 400 api_not_implemented: Felaktig begäran, möjligtvis på grund av saknade eller ogiltiga parametrar.
  • 401 invalid_token: Obefogad, ogiltig eller saknad auktoriseringstoken.
  • 429 too_many_requests: För många begärningar, du har överskridit hastighetsgränsen.
  • 500 api_error: Intern serverfel, något gick fel på servern.

Exempel på felrespons

Slutsats

Genom detta dokument har du fått en förståelse för hur du enkelt kan använda Gemini Chat Completion API för att implementera den officiella Gemini:s chattfunktionalitet. Vi hoppas att detta dokument kan hjälpa dig att bättre integrera och använda API:et. Om du har några frågor, tveka inte att kontakta vårt tekniska supportteam.