Spiegazione del sistema di prezzi GPT-5.5: piani, token e contesto

GPT-5.5 Spiegazione dei prezzi: Piani, gettoni, contesto

Risposta rapida: I prezzi dell'API GPT-5.5 partono da $5 per ogni milione di token in ingresso, $0,50 per ogni milione di token di input memorizzati nella cache, e $30 per ogni milione di token emessi. Il modello supporta una finestra di contesto di 1.050.000 token e fino a 128.000 token in uscita. È importante notare che i prompt con più di 272.000 token in ingresso comportano tassi più elevati per l'intera sessione.

GPT-5.5 è progettato per attività di programmazione complesse e lavori professionali, ma il suo prezzo non è un importo mensile fisso. Il costo effettivo dipende dalla modalità di accesso, dal numero di token inviati e ricevuti, dalla possibilità di memorizzare nella cache gli input ripetuti e dal fatto che un prompt superi o meno la soglia di prezzo prevista per i contesti lunghi.

Questa guida fa chiarezza su questi aspetti. Spiega le tariffe dei token API, i prezzi basati sul contesto esteso, le opzioni Batch e Flex, fornisce esempi pratici di costi e illustra la differenza tra il pagamento di un piano di chat e quello per l'utilizzo dell'API.

Se desideri utilizzare GPT-5.5 senza configurare la fatturazione e il codice per un account API diretto, GPT-5.5 su GlobalGPT offre un percorso più semplice per la selezione dei modelli. Consente inoltre di mantenere altri modelli di IA sulla stessa piattaforma, il che risulta utile quando per una parte del lavoro è sufficiente un modello meno costoso.

Quanto costa GPT-5.5?

OpenAI riporta i prezzi dei token di testo GPT-5.5 per ogni milione di token. Il pagina ufficiale del modello GPT-5.5 riporta i seguenti tassi di base:

Tariffe API di base GPT-5.5

Token di input$5.00per ogni milione di token
Input memorizzato nella cache$0.50per ogni milione di token
Token di output$30.00per ogni milione di token

Fonte: documentazione dei modelli OpenAI e GPT-5.5, consultata il 3 agosto 2026. I prompt lunghi e l'elaborazione regionale possono modificare il tasso effettivo.

Tipo di tokenPrezzo base per 1 milione di tokenCosa comprende
Ingresso$5.00Il tuo prompt, le istruzioni di sistema, la cronologia delle conversazioni, i documenti, i risultati degli strumenti e le immagini inserite dopo la tokenizzazione.
Input memorizzato nella cache$0.50Contenuti ripetuti ammissibili che OpenAI riconosce tramite la memorizzazione temporanea dei prompt.
Uscita$30.00I token di risposta visibili e i token di ragionamento generati dal modello vengono fatturati come output.

L'output è sei volte superiore alla tariffa di base, quindi le risposte lunghe possono incidere notevolmente sul costo finale. Un flusso di lavoro che invia un documento voluminoso ma richiede una classificazione breve potrebbe costare meno di un prompt breve che genera un rapporto molto lungo.

Non confondere i prezzi delle API con un abbonamento. Le cifre sopra riportate si riferiscono alle tariffe API a consumo. Ciò non significa che il piano GPT-5.5 costi $5 al mese, né che un abbonamento ChatGPT includa automaticamente crediti API.

Piani e percorsi di accesso GPT-5.5

“Il termine ”tariffa GPT-5.5” può riferirsi a tre diverse modalità di acquisto. Scegli la modalità prima di confrontare i dati, poiché ciascuna di esse misura l’utilizzo in modo diverso.

Percorso di accessoModalità di pagamentoIl migliore perLimitazione principale
API OpenAIUtilizzo a consumo dei token, più eventuali costi relativi agli strumentiApp, automazioni, agenti, sistemi di produzione e sviluppatori che necessitano di un controllo sull'utilizzoRichiede la configurazione dell'API, la fatturazione e il monitoraggio dei costi
Piano ChatGPTAbbonamento con limiti di accesso e utilizzo specifici per il pianoChi desidera un'interfaccia di chat già prontaLa disponibilità e i limiti possono variare a seconda del piano attuale, dell'account, della regione e della fase di implementazione
GlobalGPTPiano della piattaforma o crediti secondo le attuali condizioni di GlobalGPTChi desidera utilizzare GPT-5.5 e altri modelli in un'unica interfaccia senza dover configurare direttamente l'APII crediti sono un'unità di misura della piattaforma e non devono essere considerati come dollari API OpenAI

Elaborazione API standard

L'elaborazione standard costituisce il punto di riferimento per la maggior parte delle stime dei costi delle API. Utilizza le tariffe $5 per gli input, $0,50 per gli input memorizzati nella cache e $30 per gli output, a meno che la tua richiesta non rientri in un livello di elaborazione diverso o superi la soglia del contesto lungo.

API batch

L'API Batch di OpenAI è progettata per operazioni asincrone che non richiedono una risposta immediata. L' pagina ufficiale dei prezzi delle API elenca le tariffe ridotte per i token relative ai lavori in batch idonei. Può essere una soluzione vantaggiosa per valutazioni offline su larga scala, l'assegnazione di etichette ai documenti, l'arricchimento dei dati o l'elaborazione notturna, dove i tempi di elaborazione sono flessibili.

Elaborazione Flex

L'elaborazione Flex sacrifica la costanza dei tempi di risposta e la disponibilità a favore di prezzi più contenuti. È indicata per i lavori non di produzione o a bassa priorità che possono tollerare un'elaborazione più lenta o occasionalmente non disponibile.

Trattamento prioritario e regionale

L'elaborazione prioritaria comporta costi maggiori in cambio di un livello di servizio con priorità più elevata. Il documento OpenAI precisa inoltre che gli endpoint di elaborazione regionali comportano un aumento del 10% rispetto al GPT-5.5.

In che modo i token incidono sulla bolletta GPT-5.5

Un token è una porzione di testo o un altro tipo di input del modello. Non è la stessa cosa di una parola. Nel testo inglese, spesso si conta in media più di un token per parola, una volta inclusi punteggiatura, formattazione, codice, tabelle e caratteri speciali.

costo = (token in ingresso / 1.000.000 × tasso di ingresso) + (token in uscita / 1.000.000 × tasso di uscita)

L'input memorizzato nella cache viene calcolato secondo una tariffa separata. Le chiamate agli strumenti potrebbero comportare costi aggiuntivi, pertanto il calcolo basato sui token da solo potrebbe non corrispondere al costo finale della richiesta quando sono coinvolti la ricerca sul web, l'utilizzo del computer o altri strumenti a pagamento.

Cosa si intende per input e output?

  • Gli input comprendono suggerimenti, istruzioni di sistema, cronologia, documenti, risultati degli strumenti, dati strutturati e immagini dopo la tokenizzazione.
  • L'output include la risposta generata e i token di motivazione fatturabili.
  • L'input memorizzato nella cache comprende i contenuti ripetuti ammissibili dei prompt, riconosciuti tramite la memorizzazione nella cache dei prompt.

Finestra di contesto GPT-5.5 e soglia di prezzo di 272K

GPT-5.5 supporta un Finestra contestuale da 1.050.000 gettoni e fino a 128.000 token emessi. La finestra di contesto rappresenta lo spazio di lavoro complessivo a disposizione della richiesta, comprensivo di input, cronologia pertinente, risultati degli strumenti e output generato.

Quando un prompt GPT-5.5 contiene più di 272.000 token di input, l'intera sessione viene addebitata a Il doppio della frequenza di input normale e 1,5 volte la portata normale. Ai tassi base, ciò corrisponde a $10 per ogni milione di token in ingresso e a $45 per ogni milione di token in uscita.

Avviso pratico: Misura la richiesta finale assemblata, compresi i contenuti recuperati e la cronologia, anziché la dimensione del file iniziale.

Esempi di costi GPT-5.5

Questi esempi si basano sulle tariffe API di base ed escludono le chiamate agli strumenti a pagamento, i supplementi regionali e i moltiplicatori per contesti estesi, salvo diversa indicazione.

Calcolatore dei costi delle attività GPT-5.5

Scegli un carico di lavoro comune, quindi sposta uno dei cursori. Il calcolatore applica automaticamente un profilo rappresentativo di token per attività.

Redazione o revisione di testi
Stima per attività: 4.000 token in ingresso + 2.000 token in uscita.
Costo per attività$0.08
Volume totale dei token600.000
Costo totale stimato$8.00

100 attività × ($0,02 GPT-5.5 in ingresso + $0,06 GPT-5.5 in uscita) = $8,00

I profili relativi ai token di carico di lavoro sono stime redazionali e non costituiscono garanzie fisse di utilizzo OpenAI.

EsempioIngressoUscitaCosto stimato
Risposta breve e professionale10,0002,000$0.11
Revisione di documenti di grandi dimensioni100,00010,000$0.80
Input ripetuto di 100K con cache completamente piena100.000 in cache10,000$0.35
Sessione a contesto lungo superiore a 272K300,00020,000$3.90

Come ridurre i costi del GPT-5.5

  1. Affidare i lavori semplici a un modello più economico.
  2. Quando possibile, mantenere le istruzioni al di sotto dei 272K.
  3. Riutilizzare prefissi di prompt stabili.
  4. Imposta un limite di output.
  5. Utilizza Batch per i processi asincroni.
  6. Tieni traccia dei token per attività.
  7. Costi degli utensili separati.

Con GlobalGPT, è possibile tenere a disposizione il modello GPT-5.5 per i lavori più impegnativi e scegliere un altro modello quando la velocità o un consumo ridotto sono più importanti.

A chi è destinato GPT-5.5?

L'opzione GPT-5.5 è la scelta più sensata quando il costo di una risposta meno efficace è superiore al prezzo del token aggiuntivo. Tra gli esempi figurano modifiche complesse al codice, analisi tecniche approfondite, testi specialistici di difficile comprensione, utilizzo di strumenti in più fasi e elaborazione di documenti di grandi dimensioni.

Potrebbe non essere necessario in caso di semplici classificazioni, riscritture di base, brevi sintesi o attività su larga scala con regole prevedibili.

Domande frequenti

Quanto vale GPT-5.5 per ogni milione di token?

Il prezzo base dell'API è pari a $5 per ogni milione di token in ingresso, $0,50 per ogni milione di token in ingresso memorizzati nella cache e $30 per ogni milione di token in uscita.

Il modello GPT-5.5 è incluso nel pacchetto ChatGPT Plus?

I limiti di accesso e utilizzo dei modelli possono variare a seconda del piano, dell'account, della regione e della fase di implementazione. Consulta la pagina dei piani aggiornata e il selettore dei modelli. Gli abbonamenti ChatGPT e la fatturazione delle API sono separati.

Che cos'è la finestra contestuale GPT-5.5?

OpenAI prevede una finestra di contesto di 1.050.000 token e un output massimo di 128.000 token.

Perché il GPT-5.5 costa di più oltre i 272.000 token?

Per l'intera sessione, l'input viene addebitato al doppio e l'output a 1,5 volte il prezzo standard, poiché l'elaborazione di contesti di grandi dimensioni richiede una maggiore potenza di calcolo.

L'abbonamento ChatGPT include i token API?

Gli abbonamenti al n. ChatGPT e l'utilizzo dell'API vengono fatturati separatamente.

I crediti GlobalGPT corrispondono ai dollari API OpenAI?

I crediti n. GlobalGPT seguono il piano e le regole di utilizzo propri del GlobalGPT.

Condividi il post:

Messaggi correlati