Skip to main content
OpenAI ChatGPT — это очень мощная система AI-диалогов, которая способна за считанные секунды генерировать плавные и естественные ответы на введённые подсказки. Благодаря выдающимся способностям в понимании и генерации языка, ChatGPT занимает уникальное место в индустрии. Сегодня ChatGPT широко применяется в различных отраслях и сферах, оказывая всё более заметное влияние. Будь то повседневное общение, креативное письмо, профессиональные консультации или программирование — ChatGPT предоставляет впечатляющую интеллектуальную поддержку, значительно повышая эффективность и творческий потенциал человека. В этом документе описан процесс использования OpenAI Chat Completion 4o Image API, который позволяет легко использовать мультимодальные функции диалога официального OpenAI ChatGPT.

Процесс регистрации

Чтобы использовать OpenAI Chat Completion 4o Image API, сначала перейдите на страницу OpenAI Chat Completion 4o Image API и нажмите кнопку «Acquire» для получения необходимых учетных данных: Если вы ещё не вошли в систему или не зарегистрированы, вас автоматически перенаправит на страницу входа, где можно зарегистрироваться и войти. После входа вы автоматически вернётесь на текущую страницу. При первом запросе предоставляется бесплатный лимит, позволяющий бесплатно использовать данный API.

Модель рисования GPT-4o

Генерация изображения на основе референсного изображения

Ниже приведён пример генерации изображения в пользовательском стиле на основе исходного изображения. Сначала посмотрим на исходное изображение: Как видно, референс — фотография реального человека. Мы можем изменить стиль, например, сделать изображение в стиле аниме. Пример запроса:
Пример ответа:
В поле choicesmessage.content содержится полный результат диалога, изображение включено в формате Markdown (ссылка на изображение временная, рекомендуется скачать и сохранить). Как видно, сгенерированное изображение действительно выполнено в стиле аниме, пример ниже:

Генерация изображения по текстовому описанию

Можно сгенерировать изображение, используя только текстовую подсказку, и получить результат в формате диалога. Например, запрос «Создать изображение футуристического города на закате». Пример запроса:
Пример ответа:
Как видно, результат соответствует подсказке, пример ниже:

Генерация одного изображения на основе нескольких

Можно использовать несколько референсных изображений для генерации одного. Например, используя фото красивого мужчины и кофе, можно создать изображение мужчины, держащего кофе и готовящегося его пить. Ниже — исходные изображения:

Пример запроса «Сгенерировать изображение мужчины, держащего кофе и готовящегося его пить»:
Пример ответа:
Как видно, результат действительно объединяет оба изображения, пример ниже:

Обработка ошибок

При вызове API, если возникает ошибка, API возвращает соответствующий код и сообщение об ошибке. Например:
  • 400 token_mismatched: Неверный запрос, возможно, из-за отсутствующих или некорректных параметров.
  • 400 api_not_implemented: Неверный запрос, возможно, из-за отсутствующих или некорректных параметров.
  • 401 invalid_token: Неавторизован, неверный или отсутствующий токен авторизации.
  • 429 too_many_requests: Слишком много запросов, превышен лимит частоты.
  • 500 api_error: Внутренняя ошибка сервера.

Пример ответа с ошибкой

Заключение

В этом документе вы узнали, как использовать OpenAI Chat Completion 4o Image API для лёгкой реализации мультимодальной обработки изображений официального OpenAI ChatGPT. Надеемся, что этот документ поможет вам лучше интегрировать и использовать данный API. Если у вас возникнут вопросы, пожалуйста, обращайтесь в нашу техническую поддержку.