Skip to main content
OpenAI ChatGPT è un potente sistema di dialogo AI che, inserendo una parola chiave, può generare risposte fluide e naturali in pochi secondi. ChatGPT si distingue nel settore per la sua eccellente comprensione e capacità di generazione del linguaggio; oggi, ChatGPT è ampiamente utilizzato in vari settori e ambiti, la sua influenza è sempre più significativa. Che si tratti di conversazioni quotidiane, scrittura creativa, consulenze professionali o programmazione di codice, ChatGPT può fornire un’assistenza intelligente sorprendente, aumentando notevolmente l’efficienza e la creatività umana. Questo documento descrive principalmente il processo di utilizzo dell’API OpenAI Chat Completion, che ci consente di utilizzare facilmente le funzionalità di dialogo ufficiali di OpenAI ChatGPT.

Processo di richiesta

Per utilizzare l’API OpenAI Chat Completion, è possibile visitare la pagina OpenAI Chat Completion API e fare clic sul pulsante “Acquire” per ottenere le credenziali necessarie per la richiesta: Se non si è ancora registrati o loggati, si verrà automaticamente reindirizzati alla pagina di accesso per registrarsi e accedere; dopo aver effettuato la registrazione e l’accesso, si tornerà automaticamente alla pagina corrente. Alla prima richiesta, verrà fornito un credito gratuito, che consente di utilizzare l’API senza costi.

Utilizzo di base

Successivamente, è possibile compilare i contenuti corrispondenti nell’interfaccia, come mostrato nell’immagine:

Quando si utilizza l’interfaccia per la prima volta, è necessario compilare almeno tre contenuti: uno è authorization, che può essere selezionato direttamente dal menu a discesa. Un altro parametro è model, che rappresenta la categoria del modello di OpenAI ChatGPT che si desidera utilizzare; qui abbiamo principalmente 20 modelli, i dettagli possono essere consultati nei modelli forniti. L’ultimo parametro è messages, che è un array di parole chiave che inseriamo; rappresenta un array che consente di caricare più parole chiave contemporaneamente, ogni parola chiave contiene role e content, dove role indica il ruolo del richiedente; abbiamo fornito tre identità: user, assistant, system. L’altro content è il contenuto specifico della nostra domanda. Inoltre, si può notare che a destra c’è un codice di chiamata corrispondente generato; è possibile copiare il codice e eseguirlo direttamente, oppure fare clic sul pulsante “Try” per testarlo. Parametri opzionali comuni:
  • max_tokens: limita il numero massimo di token nella risposta.
  • temperature: genera casualità, tra 0-2, valori più alti portano a maggiore dispersione.
  • n: quante risposte candidate generare in una volta.
  • response_format: impostazione del formato di ritorno.

Dopo la chiamata, scopriamo che il risultato restituito è il seguente:
Il risultato restituito contiene diversi campi, descritti come segue:
  • id, l’ID della generazione di questo compito di dialogo, utilizzato per identificare univocamente questo compito di dialogo.
  • model, il modello di OpenAI ChatGPT selezionato.
  • choices, le informazioni di risposta fornite da ChatGPT in base alle parole chiave.
  • usage: informazioni statistiche sui token per questa domanda e risposta.
Tra cui choices contiene le informazioni di risposta di ChatGPT, dove si può notare come mostrato nell’immagine.

Si può vedere che il campo content all’interno di choices contiene il contenuto specifico della risposta di ChatGPT.

Risposta in streaming

Questa interfaccia supporta anche le risposte in streaming, il che è molto utile per l’integrazione web, consentendo di visualizzare il contenuto parola per parola. Se si desidera restituire una risposta in streaming, è possibile modificare il parametro stream nell’intestazione della richiesta, impostandolo su true. La modifica è mostrata nell’immagine, ma il codice di chiamata deve essere adeguatamente modificato per supportare la risposta in streaming.

Dopo aver modificato stream in true, l’API restituirà i dati JSON riga per riga; a livello di codice, è necessario apportare le modifiche necessarie per ottenere i risultati riga per riga. Esempio di codice di chiamata in Python:
L’output sarà il seguente:
Puoi vedere che nella risposta ci sono molti data, data contiene choices che rappresentano il contenuto della risposta più recente, coerente con quanto descritto in precedenza. choices è il contenuto della risposta aggiunto, che puoi integrare nel tuo sistema. Inoltre, la fine della risposta in streaming è determinata dal contenuto di data; se il contenuto è [FINE], significa che la risposta in streaming è completamente terminata. I risultati restituiti da data hanno diversi campi, descritti come segue:
  • id, l’ID generato per questa attività di conversazione, utilizzato per identificare univocamente questa attività di conversazione.
  • model, il modello scelto dal sito ufficiale di OpenAI ChatGPT.
  • choices, le informazioni di risposta fornite da ChatGPT in base alla domanda.
JavaScript è supportato, ad esempio, il codice per la chiamata in streaming di Node.js è il seguente:
Esempio di codice Java:
Altre lingue possono essere riscritte autonomamente, il principio è lo stesso.

Conversazione a più turni

Se desideri integrare la funzionalità di conversazione a più turni, devi caricare più domande nel campo messages, un esempio specifico di più domande è mostrato nell’immagine sottostante:

Esempio di codice Python:
Attraverso il caricamento di più domande, è possibile realizzare facilmente un dialogo a più turni, ottenendo la seguente risposta:
Si può notare che le informazioni contenute in choices sono coerenti con il contenuto di base utilizzato, includendo il contenuto specifico delle risposte di ChatGPT a più dialoghi, permettendo così di rispondere a domande corrispondenti in base ai contenuti di più dialoghi.

Integrazione con OpenAI-Python

Il servizio OpenAI Chat Completion API è alimentato dal servizio ufficiale di OpenAI, per dettagli si può consultare il OpenAI-Python ufficiale, in questo articolo verrà fornita una breve introduzione su come utilizzare il servizio fornito ufficialmente.
  1. Prima di tutto, è necessario impostare un ambiente Python locale, questo processo può essere cercato su Google.
  2. Scaricare e installare l’ambiente di sviluppo, ad esempio installare l’editor VSCode.
  3. Configurare le variabili d’ambiente OpenAI.
  • Nella cartella del progetto, creare un file chiamato .env e salvarlo.
  • Contenuto del file .env:
Sostituisci sk-xxx con la tua chiave. OPENAI_BASE_URL è l’interfaccia proxy per accedere a OpenAI.
  1. Installare i pacchetti dipendenti del progetto
Il comando per Mac OS è:
  1. Creare un file di codice sorgente di esempio
Supponiamo di aver creato un codice di esempio index.py, il contenuto specifico è il seguente:

Modello di navigazione

I modelli gpt-3.5-browsing e gpt-4-browsing sono diversi dagli altri modelli, possono effettuare ricerche online in base alle domande e restituire i risultati della ricerca online con le dovute modifiche, in questo articolo verrà mostrato un esempio concreto per dimostrare la funzionalità di navigazione, successivamente si possono compilare i contenuti corrispondenti nell’interfaccia OpenAI Chat Completion API, come mostrato nell’immagine:

Allo stesso tempo, puoi notare che a destra ci sono i codici di chiamata generati corrispondenti, puoi copiare il codice e eseguirlo direttamente, oppure puoi semplicemente fare clic sul pulsante “Prova” per testarlo.

Dopo la chiamata, abbiamo scoperto che il risultato restituito è il seguente:
Si può notare che le informazioni di risposta all’interno di choices sono state ottenute in base alla ricerca online e sono stati forniti anche i link pertinenti, le informazioni di risposta all’interno di choices devono essere renderizzate utilizzando la sintassi markdown, in modo da ottenere la migliore esperienza, infine questo dimostra anche il potente vantaggio della funzionalità di navigazione del nostro modello.

Modello visivo

gpt-4o è un modello linguistico di grandi dimensioni multimodale sviluppato da OpenAI, che ha aumentato la capacità di comprensione visiva sulla base di GPT-4. Questo modello può gestire simultaneamente input di testo e immagini, realizzando una comprensione e generazione cross-modale. L’elaborazione del testo utilizzando il modello gpt-4o è coerente con il contenuto di base utilizzato in precedenza, di seguito verrà fornita una breve introduzione su come utilizzare la capacità di elaborazione delle immagini del modello. L’uso della capacità di elaborazione delle immagini del modello gpt-4o avviene principalmente aggiungendo un campo type al contenuto content originale, attraverso il quale si può sapere se ciò che viene caricato è testo o immagine, permettendo così di utilizzare la capacità di elaborazione delle immagini del modello gpt-4o, di seguito si parlerà principalmente di come chiamare questa funzionalità utilizzando Curl e Python.
  • Metodo Curl
  • Metodo Python
Poi si può ottenere il seguente risultato, le informazioni dei campi nel risultato sono coerenti con quelle sopra, nello specifico come segue:
Si può notare che il contenuto della risposta è basato sull’immagine, quindi attraverso i due metodi sopra si può facilmente utilizzare le capacità di elaborazione di testo e immagine del modello gpt-4-vision. Oltre a gpt-4o, c’è un modello a costo inferiore chiamato gpt-4o-mini. gpt-4o-mini è l’ultima generazione di modelli di linguaggio di grandi dimensioni sviluppati da OpenAI, che non solo ha una velocità di risposta rapida, ma è anche più economico e supporta il multimodale. L’uso delle funzionalità di visione può fare riferimento al contenuto dell’uso del modello gpt-4o sopra.

Modello di disegno GPT-4o

Esempio di richiesta:
Esempio di risultato:

Gestione degli errori

Quando si chiama l’API, se si verifica un errore, l’API restituirà il codice di errore e le informazioni corrispondenti. Ad esempio:
  • 400 token_mismatched: Richiesta non valida, probabilmente a causa di parametri mancanti o non validi.
  • 400 api_not_implemented: Richiesta non valida, probabilmente a causa di parametri mancanti o non validi.
  • 401 invalid_token: Non autorizzato, token di autorizzazione non valido o mancante.
  • 429 too_many_requests: Troppe richieste, hai superato il limite di frequenza.
  • 500 api_error: Errore interno del server, qualcosa è andato storto sul server.

Esempio di risposta di errore

Conclusione

Attraverso questo documento, hai compreso come utilizzare facilmente l’API OpenAI Chat Completion per implementare le funzionalità di conversazione di OpenAI ChatGPT. Speriamo che questo documento possa aiutarti a integrare e utilizzare meglio questa API. Se hai domande, non esitare a contattare il nostro team di supporto tecnico.