Skip to main content
OpenAI ChatGPT to bardzo potężny system AI do rozmów, który potrafi wygenerować płynne i naturalne odpowiedzi w ciągu kilku sekund po wprowadzeniu promptu. ChatGPT wyróżnia się w branży dzięki doskonałemu rozumieniu i generowaniu języka. Obecnie ChatGPT jest szeroko stosowany w różnych branżach i dziedzinach, a jego wpływ jest coraz bardziej zauważalny. Niezależnie od tego, czy chodzi o codzienne rozmowy, twórcze pisanie, profesjonalne konsultacje czy programowanie, ChatGPT oferuje zdumiewającą inteligentną pomoc, znacznie zwiększając efektywność pracy i kreatywność ludzi. Niniejszy dokument przedstawia głównie proces korzystania z OpenAI Chat Completion 4o Image API, dzięki któremu możemy łatwo korzystać z oficjalnej, multimodalnej funkcji dialogowej OpenAI ChatGPT.

Proces wnioskowania

Aby korzystać z OpenAI Chat Completion 4o Image API, najpierw przejdź na stronę OpenAI Chat Completion 4o Image API i kliknij przycisk „Acquire”, aby uzyskać wymagane poświadczenia do żądania: Jeśli nie jesteś jeszcze zalogowany lub zarejestrowany, zostaniesz automatycznie przekierowany na stronę logowania, gdzie możesz się zarejestrować i zalogować. Po zalogowaniu lub rejestracji zostaniesz automatycznie przeniesiony z powrotem na tę stronę. Przy pierwszym wniosku otrzymasz darmowy limit, który pozwala na bezpłatne korzystanie z tego API.

Model rysunkowy GPT-4o

Generowanie obrazu na podstawie obrazu referencyjnego

Poniżej znajduje się przykład generowania obrazu o niestandardowym stylu na podstawie jednego obrazu. Najpierw zobaczmy obraz wejściowy, jak poniżej: Widać, że obraz referencyjny to zdjęcie prawdziwej osoby. Możemy zmienić jego styl, na przykład na styl anime. Przykładowe żądanie wygląda następująco:
Przykładowy wynik:
W polu choices w message.content znajduje się wygenerowany pełny wynik dialogu, a obraz jest zawarty w formacie Markdown (link do obrazu jest tymczasowy, prosimy o szybkie pobranie i zapisanie). Można zauważyć, że wygenerowany obraz rzeczywiście ma styl anime, jak pokazano poniżej:

Generowanie obrazu na podstawie samego tekstu

Możemy wygenerować obraz na podstawie promptu tekstowego i otrzymać wynik w formie dialogu. Poniżej przykład z promptem „创建一张未来城市日落的图片” (stwórz obraz zachodu słońca w futurystycznym mieście):
Przykładowy wynik:
Wynik odpowiada promptowi, jak pokazano poniżej:

Generowanie jednego obrazu na podstawie wielu obrazów

Możemy również użyć wielu obrazów referencyjnych do wygenerowania jednego obrazu, na przykład wykorzystując zdjęcie przystojnego mężczyzny i zdjęcie kawy, aby stworzyć obraz mężczyzny pijącego kawę. Poniżej znajdują się obrazy referencyjne:

Jako przykład użyjemy promptu „生成男生举着咖啡,并且马上要喝的样子” (wygeneruj obraz chłopaka trzymającego kawę i zaraz ją pijącego). Przykładowe żądanie:
Przykładowy wynik:
Widać, że wygenerowany obraz faktycznie łączy oba obrazy referencyjne, jak pokazano poniżej:

Obsługa błędów

Podczas wywoływania API, jeśli wystąpi błąd, API zwróci odpowiedni kod błędu i informacje. Na przykład:
  • 400 token_mismatched: Nieprawidłowe żądanie, prawdopodobnie z powodu brakujących lub nieprawidłowych parametrów.
  • 400 api_not_implemented: Nieprawidłowe żądanie, prawdopodobnie z powodu brakujących lub nieprawidłowych parametrów.
  • 401 invalid_token: Brak autoryzacji, nieprawidłowy lub brakujący token autoryzacyjny.
  • 429 too_many_requests: Zbyt wiele żądań, przekroczono limit zapytań.
  • 500 api_error: Błąd wewnętrzny serwera, coś poszło nie tak po stronie serwera.

Przykład odpowiedzi błędu

Podsumowanie

Dzięki temu dokumentowi nauczyłeś się, jak łatwo korzystać z OpenAI Chat Completion 4o Image API, aby uzyskać multimodalne funkcje przetwarzania obrazów oficjalnego OpenAI ChatGPT. Mamy nadzieję, że ten dokument pomoże Ci lepiej integrować i używać tego API. W razie jakichkolwiek pytań, prosimy o kontakt z naszym zespołem wsparcia technicznego.