Skip to main content
OpenAI ChatGPT は非常に強力な AI 対話システムであり、プロンプトを入力するだけで数秒以内に流暢で自然な応答を生成できます。ChatGPT は優れた言語理解と生成能力で業界内で独自の地位を築いており、現在では様々な業界や分野で広く活用され、その影響力はますます顕著になっています。日常会話、クリエイティブライティング、専門的な相談、コードプログラミングなど、あらゆる場面で驚くべきインテリジェントな支援を提供し、人間の作業効率と創造力を大幅に向上させています。 本ドキュメントでは、OpenAI Chat Completion 4o Image API の操作手順について紹介します。これを利用することで、公式の OpenAI ChatGPT のマルチモーダル対話機能を簡単に使用できます。

申請手順

OpenAI Chat Completion 4o Image API を使用するには、まず OpenAI Chat Completion 4o Image API ページで「Acquire」ボタンをクリックし、リクエストに必要な認証情報を取得します: まだログインまたは登録していない場合は、自動的にログインページにリダイレクトされ、登録およびログインを促されます。ログイン・登録後は自動的に現在のページに戻ります。 初回申請時には無料の利用枠が付与され、この API を無料で利用可能です。

GPT-4o 描画モデル

参考画像をもとに画像生成

以下は、ある画像をもとにカスタムスタイルの画像を生成する例です。まず、入力する画像を見てみましょう: 参考画像は実写の人物写真であることがわかります。これをアニメ風の画像に変換することが可能です。具体的なリクエスト例は以下の通りです:
サンプル結果:
choices 内の message.content が生成された完全な対話結果であり、画像は Markdown 形式で含まれています(画像リンクは一時的なアドレスのため、速やかにダウンロードして保存してください)。生成された画像は確かにアニメ風で、以下のようになっています:

テキストのみで画像生成

プロンプトだけで画像を生成し、対話形式の結果として返すことも可能です。例として「未来都市の日没の画像を作成する」を試してみます。具体的なリクエスト例は以下の通りです:
サンプル結果:
結果はプロンプトに沿った内容で、以下のようになっています:

複数画像から一枚の画像生成

複数の参考画像を使って一枚の画像を生成することも可能です。例えば、イケメンの写真とコーヒーの写真を使い、イケメンがコーヒーを飲もうとしている様子の画像を生成します。参考画像は以下の通りです:

「男の子がコーヒーを持って、これから飲もうとしている様子を生成する」という例の具体的なリクエストは以下の通りです:
サンプル結果:
生成された結果は確かに二つの画像を組み合わせて生成されており、具体的な結果は以下の通りです:

エラー処理

API 呼び出し時にエラーが発生した場合、API は対応するエラーコードとメッセージを返します。例:
  • 400 token_mismatched:不正なリクエスト、パラメータの不足や無効の可能性があります。
  • 400 api_not_implemented:不正なリクエスト、パラメータの不足や無効の可能性があります。
  • 401 invalid_token:認証エラー、無効または欠落した認証トークン。
  • 429 too_many_requests:リクエスト過多、レート制限を超過しました。
  • 500 api_error:サーバー内部エラー、サーバー側で問題が発生しました。

エラー応答例

結論

本ドキュメントを通じて、OpenAI Chat Completion 4o Image API を利用して公式 OpenAI ChatGPT のマルチモーダル画像処理機能を簡単に実現する方法をご理解いただけたかと思います。本ドキュメントが API の連携および利用に役立つことを願っています。ご不明点がございましたら、いつでも技術サポートチームまでお問い合わせください。