Skip to main content
Google Gemini는 매우 강력한 AI 대화 시스템으로, 입력한 프롬프트에 따라 몇 초 만에 유창하고 자연스러운 응답을 생성할 수 있습니다. Gemini는 놀라운 지능적 지원을 제공하여 인간의 작업 효율성과 창의성을 크게 향상시킵니다. 이 문서는 Gemini Chat Completion API 사용 프로세스를 주로 설명하며, 이를 통해 공식 Gemini의 대화 기능을 쉽게 사용할 수 있습니다.

신청 프로세스

Gemini Chat Completion API를 사용하려면 먼저 Ace Data Cloud 콘솔에서 API Token을 받아야 합니다. 이를 보관해 두세요. 로그인이나 등록이 되어 있지 않으면 자동으로 로그인 페이지로 리디렉션되어 등록 및 로그인을 요청합니다. 완료 후 현재 페이지로 자동으로 돌아옵니다. 하나의 API Token으로 플랫폼의 모든 서비스를 호출할 수 있으며, 각 서비스에 대해 별도로 신청할 필요가 없습니다. 처음 신청 시 무료 할당량이 제공되어 무료로 체험할 수 있습니다; 할당량이 부족할 경우 콘솔에서 일반 잔액을 충전할 수 있습니다.
📘 전체 문서: Gemini Chat Completion API →

기본 사용

이제 인터페이스에 해당 내용을 입력할 수 있습니다. 아래 그림과 같이 진행하세요:

이 API를 처음 사용할 때는 최소한 세 가지 내용을 입력해야 합니다. 하나는 authorization으로, 드롭다운 목록에서 선택하면 됩니다. 또 다른 매개변수는 model로, model은 Gemini 공식 모델 카테고리를 선택하는 것입니다. 여기에는 주로 6가지 모델이 있으며, 자세한 내용은 제공된 모델을 참조하세요. 마지막 매개변수는 messages로, messages는 우리가 입력하는 질문어 배열입니다. 이는 배열로, 여러 질문어를 동시에 업로드할 수 있으며, 각 질문어는 rolecontent를 포함합니다. 여기서 role은 질문자의 역할을 나타내며, 우리는 user, assistant, system의 세 가지 신원을 제공합니다. 또 다른 content는 우리가 질문하는 구체적인 내용입니다. 또한 오른쪽에 해당 호출 코드 생성이 있음을 주목할 수 있으며, 코드를 복사하여 직접 실행하거나 “Try” 버튼을 클릭하여 테스트할 수 있습니다.

: gemini-3.x 시리즈 flash는 사고 모델로, 먼저 reasoning tokens를 소모합니다; max_tokens를 512 이상으로 설정해야 하며, 그렇지 않으면 빈 내용만 반환될 수 있습니다. gemini-3.6-flash는 현재 추천되는 Flash 모델로, 최대 100만 Token의 컨텍스트, 이미지 입력, 도구 호출 및 스트리밍 응답을 지원합니다; 현재 Chat Completions 인터페이스를 통해 호출됩니다.
호출 후, 반환된 결과는 다음과 같습니다:
반환된 결과는 여러 필드를 포함하며, 다음과 같이 설명됩니다:
  • id, 이번 대화 작업을 생성한 ID로, 이번 대화 작업을 고유하게 식별하는 데 사용됩니다.
  • model, 선택한 Gemini 공식 모델입니다.
  • choices, Gemini가 질문어에 대해 제공한 응답 정보입니다.
  • usage: 이번 질문-응답 쌍에 대한 token 통계 정보입니다.
그 중 choices는 Gemini의 응답 정보를 포함하고 있으며, 그 안의 choices는 Gemini의 구체적인 응답 정보를 보여줍니다. 아래 그림과 같이 확인할 수 있습니다.

choices 안의 content 필드에는 Gemini의 응답 내용이 포함되어 있습니다.

이미지 이해 (다중 모달 입력)

Gemini는 원주율 다중 모달 모델로, 직접 “이미지를 볼” 수 있습니다. 이미지를 전달하려면 특정 메시지의 content를 문자열에서 내용 블록 배열로 변경하고, 배열에 text 블록과 image_url 블록을 동시에 넣으면 됩니다. 이는 OpenAI 및 공식 Gemini의 OpenAI 호환 형식과 완전히 일치합니다. image_url.url은 두 가지 형식을 지원합니다:
  • base64 data: URI (추천, 가장 안정적): 형식은 data:<미디어 유형>;base64,<데이터>이며, 예를 들어 data:image/jpeg;base64,/9j/4AAQ...입니다. 미디어 유형(MIME)은 data: 접두사에 이미 포함되어 있으므로, 별도의 media_type 필드는 필요하지 않습니다.
  • 공개 접근 가능한 이미지 URL: 예를 들어 https://cdn.acedata.cloud/4hfydw.jpg입니다.
지원되는 이미지 유형: png, jpeg, webp, heic, heif입니다. Python 샘플 호출 코드 (base64 data URI):
공개적으로 접근 가능한 이미지 URL을 직접 전달할 수도 있습니다:
💡 image_urlurl 필드(값은 이미지 URL 또는 base64 data: URI)와 선택적 detail 필드만 허용합니다. media_type을 전달하지 마세요 — 이는 Anthropic Claude의 이미지 필드로 OpenAI / Gemini의 image_url 형식에 해당하지 않습니다.

스트리밍 응답

이 인터페이스는 스트리밍 응답도 지원하며, 이는 웹 페이지 통합에 매우 유용하여 웹 페이지에서 단어별 표시 효과를 구현할 수 있습니다. 스트리밍 응답을 원하시면 요청 헤더의 stream 매개변수를 true로 변경하면 됩니다. 변경 사항은 아래와 같지만, 호출 코드도 스트리밍 응답을 지원하도록 적절한 변경이 필요합니다.

streamtrue로 변경하면 API는 해당 JSON 데이터를 한 줄씩 반환하며, 코드 측면에서 우리는 한 줄씩 결과를 얻기 위해 적절한 수정을 해야 합니다. Python 샘플 호출 코드:
출력 효과는 다음과 같습니다:
응답에서 많은 data가 있으며, data 안의 choices가 최신의 답변 내용입니다. choices는 추가된 답변 내용으로, 결과에 따라 시스템에 통합할 수 있습니다. 또한 스트리밍 응답의 종료는 data의 내용을 기준으로 판단하며, 내용이 [DONE]이면 스트리밍 응답이 모두 종료된 것입니다. 반환된 data 결과는 여러 필드를 포함하고 있으며, 다음과 같이 설명됩니다:
  • id,이번 대화 작업의 ID로, 이번 대화 작업을 고유하게 식별하는 데 사용됩니다.
  • model ,선택한 Gemini 공식 모델입니다.
  • choices,Gemini가 질문에 대해 제공하는 답변 정보입니다.
JavaScript도 지원되며, 예를 들어 Node.js의 스트리밍 호출 코드는 다음과 같습니다:
Java 샘플 코드:
다른 언어는 별도로 수정할 수 있으며, 원리는 모두 동일합니다.

다중 대화

다중 대화 기능을 연결하려면 messages 필드에 여러 질문을 업로드해야 하며, 여러 질문의 구체적인 예시는 아래 그림과 같습니다:

Python 샘플 호출 코드:
여러 질문을 업로드하면 쉽게 다중 대화를 구현할 수 있으며, 다음과 같은 답변을 얻을 수 있습니다:
choices에 포함된 정보는 기본 사용 내용과 일치하며, 이는 Gemini가 여러 대화에 대해 응답하는 구체적인 내용을 포함하고 있어 여러 대화 내용을 바탕으로 해당 질문에 답변할 수 있습니다.

Gemini-3.0 다중 모달 모델

요청 샘플:
샘플 결과:
물론 비디오 링크도 전달할 수 있습니다. 구체적인 입력은 다음과 같습니다:
샘플 결과:
위에서 볼 수 있듯이 Gemini 3.0 모델은 다중 모달 이해를 지원합니다.

Gemini-3.1 다중 모달 모델

gemini-3.1-pro-preview는 현재 Gemini 3.1 Pro의 공식 모델 ID로, 텍스트, 이미지, 비디오 등 다중 모달 입력을 지원하며 복잡한 추론, 코딩 및 이해 작업에 적합합니다. 요청 샘플:
Gemini 3.1 Pro는 비디오 이해도 지원합니다:
반환 형식은 Gemini 3.0 Pro와 일치하며, 자세한 내용은 위의 Gemini-3.0 다중 모달 모델 섹션의 설명을 참조하십시오.

오류 처리

API를 호출할 때 오류가 발생하면 API는 해당 오류 코드와 정보를 반환합니다. 예를 들어:
  • 400 token_mismatched: 잘못된 요청, 누락되거나 잘못된 매개변수 때문일 수 있습니다.
  • 400 api_not_implemented: 잘못된 요청, 누락되거나 잘못된 매개변수 때문일 수 있습니다.
  • 401 invalid_token: 인증되지 않음, 잘못되었거나 누락된 인증 토큰입니다.
  • 429 too_many_requests: 너무 많은 요청, 비율 제한을 초과했습니다.
  • 500 api_error: 내부 서버 오류, 서버에서 문제가 발생했습니다.

오류 응답 예시

결론

이 문서를 통해 Gemini Chat Completion API를 사용하여 공식 Gemini의 대화 기능을 쉽게 구현하는 방법을 이해하셨습니다. 이 문서가 해당 API를 더 잘 연동하고 사용하는 데 도움이 되기를 바랍니다. 질문이 있으시면 언제든지 저희 기술 지원 팀에 문의해 주십시오.