Skip to main content
OpenAI ChatGPT är ett mycket kraftfullt AI-konversationssystem som kan generera flytande och naturliga svar på bara några sekunder genom att mata in en prompt. ChatGPT utmärker sig i branschen tack vare sin utmärkta språkförståelse och genereringsförmåga. Idag används ChatGPT brett inom olika branscher och områden, och dess påverkan blir allt mer betydande. Oavsett om det gäller vardagliga samtal, kreativt skrivande, professionell rådgivning eller kodprogrammering, kan ChatGPT erbjuda imponerande intelligent assistans som avsevärt förbättrar människors arbetsproduktivitet och kreativitet. Detta dokument beskriver huvudsakligen användningsprocessen för OpenAI Chat Completion 4o Image API, med vilket vi enkelt kan använda den officiella OpenAI ChatGPT:s multimodala konversationsfunktion.

Ansökningsprocess

För att använda OpenAI Chat Completion 4o Image API kan du först gå till sidan OpenAI Chat Completion 4o Image API och klicka på knappen “Acquire” för att få de nödvändiga autentiseringsuppgifterna för förfrågningar: Om du inte är inloggad eller registrerad kommer du automatiskt att omdirigeras till inloggningssidan där du kan registrera dig och logga in. Efter inloggning eller registrering återvänder du automatiskt till den aktuella sidan. Vid första ansökan får du en gratis kvot som gör att du kan använda API:et utan kostnad.

GPT-4o ritmodell

Generera bild baserat på referensbild

Nedan är ett exempel på hur man genererar en bild med anpassad stil utifrån en bild. Först tittar vi på vår ingångsbild, som visas nedan: Referensbilden är en bild på en verklig person. Vi kan låta den ändras till en annan stil, till exempel en anime-stil. Här är ett exempel på en förfrågan:
Exempelresultat:
I choices finns message.content som är det genererade fullständiga samtalsresultatet, där bilden är inkluderad i Markdown-format (bildlänken är en temporär adress, vänligen ladda ner och spara i tid). Det är tydligt att den genererade bilden verkligen är i anime-stil, som visas nedan:

Bildgenerering från ren text

Vi kan generera en bild genom en prompt och få resultatet i dialogformat. Här är ett exempel med prompten 创建一张未来城市日落的图片 (Skapa en bild av en futuristisk stad i solnedgång). Här är ett konkret exempel:
Exempelresultat:
Resultatet stämmer väl överens med prompten, som visas nedan:

Generera en bild från flera bilder

Vi kan också använda flera referensbilder för att generera en bild, till exempel en bild på en snygg kille och en bild på kaffe. Med dessa två bilder kan vi generera en bild på en kille som dricker kaffe. Här är referensbilderna:

Här är ett exempel med prompten 生成男生举着咖啡,并且马上要喝的样子 (Generera en bild på en kille som håller i kaffe och är på väg att dricka):
Exempelresultat:
Det genererade resultatet kombinerar tydligt de två bilderna, som visas nedan:

Felhantering

När du anropar API:et och stöter på fel kommer API:et att returnera motsvarande felkod och meddelande. Exempel:
  • 400 token_mismatched: Felaktig förfrågan, möjligtvis på grund av saknade eller ogiltiga parametrar.
  • 400 api_not_implemented: Felaktig förfrågan, möjligtvis på grund av saknade eller ogiltiga parametrar.
  • 401 invalid_token: Obefogad åtkomst, ogiltig eller saknad auktoriseringstoken.
  • 429 too_many_requests: För många förfrågningar, du har överskridit hastighetsbegränsningen.
  • 500 api_error: Intern serverfel, något gick fel på servern.

Exempel på felrespons

Slutsats

Genom detta dokument har du lärt dig hur du enkelt använder OpenAI Chat Completion 4o Image API för att realisera den officiella OpenAI ChatGPT:s multimodala bildbehandlingsfunktion. Vi hoppas att detta dokument hjälper dig att bättre integrera och använda API:et. Om du har några frågor, tveka inte att kontakta vårt tekniska supportteam.