Skip to main content
OpenAI ChatGPT é um sistema de diálogo de IA extremamente poderoso, que pode gerar respostas fluentes e naturais em poucos segundos a partir de um prompt. O ChatGPT se destaca na indústria por sua excelente capacidade de compreensão e geração de linguagem. Atualmente, o ChatGPT já é amplamente utilizado em diversos setores e áreas, com impacto cada vez mais significativo. Seja para conversas diárias, escrita criativa, consultoria profissional ou programação de código, o ChatGPT oferece uma assistência inteligente impressionante, aumentando muito a eficiência e criatividade humanas. Este documento apresenta principalmente o fluxo de uso da API OpenAI Chat Completion 4o Image, que permite utilizar facilmente a funcionalidade multimodal de diálogo oficial do OpenAI ChatGPT.

Processo de Solicitação

Para usar a API OpenAI Chat Completion 4o Image, você pode acessar a página OpenAI Chat Completion 4o Image API e clicar no botão “Acquire” para obter as credenciais necessárias para a requisição: Se você ainda não estiver logado ou registrado, será redirecionado automaticamente para a página de login, onde poderá se registrar e entrar. Após o login ou registro, você será redirecionado automaticamente para esta página. Na primeira solicitação, será concedida uma cota gratuita para uso da API.

Modelo de Desenho GPT-4o

Gerar imagem a partir de imagem de referência

A seguir, um exemplo de geração de imagem com estilo personalizado a partir de uma imagem. Primeiro, veja a imagem de entrada: Como pode ser visto, a imagem de referência é uma foto real de uma pessoa. Podemos transformá-la em um estilo diferente, por exemplo, em estilo anime. O exemplo de requisição é:
Exemplo de resultado:
Dentro de choices, o campo message.content contém o resultado completo da conversa, incluindo a imagem em formato Markdown (o link da imagem é temporário, faça o download e salve o quanto antes). Pode-se ver que a imagem gerada está realmente no estilo anime, conforme mostrado abaixo:

Geração de imagem apenas por texto

Também podemos gerar uma imagem a partir de um prompt textual, com o resultado retornado em formato de diálogo. Por exemplo, para o prompt Criar uma imagem de uma cidade futurista ao pôr do sol, o exemplo é:
Exemplo de resultado:
O resultado está de acordo com o prompt, conforme mostrado abaixo:

Gerar uma imagem a partir de múltiplas imagens

Também é possível usar várias imagens de referência para gerar uma única imagem. Por exemplo, usando uma imagem de um homem bonito e outra de café, podemos gerar uma imagem de um homem bebendo café. As imagens de referência são:

Como exemplo, para o prompt Gerar um homem segurando café, prestes a beber, o exemplo é:
Exemplo de resultado:
Como pode ser visto, o resultado gerado combina as duas imagens, conforme mostrado abaixo:

Tratamento de Erros

Ao chamar a API, se ocorrer um erro, a API retornará o código e a mensagem de erro correspondentes. Por exemplo:
  • 400 token_mismatched: Requisição inválida, possivelmente devido a parâmetros ausentes ou inválidos.
  • 400 api_not_implemented: Requisição inválida, possivelmente devido a parâmetros ausentes ou inválidos.
  • 401 invalid_token: Não autorizado, token de autorização inválido ou ausente.
  • 429 too_many_requests: Muitas requisições, você excedeu o limite de taxa.
  • 500 api_error: Erro interno do servidor, algo deu errado no servidor.

Exemplo de resposta de erro

Conclusão

Com este documento, você aprendeu como usar a API OpenAI Chat Completion 4o Image para implementar facilmente a funcionalidade multimodal de processamento de imagens do OpenAI ChatGPT oficial. Esperamos que este documento ajude você a integrar e usar melhor esta API. Caso tenha qualquer dúvida, não hesite em contatar nossa equipe de suporte técnico.