Buinsoft
Torna al blog
AI SolutionsIT Consulting

GPT-5.6 per le aziende: Sol, Terra e Luna spiegati

B
Buinsoft TeamAutore
GPT-5.6 per le aziende: Sol, Terra e Luna spiegati
Risposta rapida: Il 9 luglio 2026 OpenAI ha reso GPT-5.6 disponibile in via generale come tre modelli. Sol è il livello top per il ragionamento complesso e i lunghi compiti da agente. Terra è il modello equilibrato di tutti i giorni, capace quasi quanto GPT-5.5 ma a metà del prezzo. Luna è quello veloce ed economico, pensato per i grandi volumi. Il numero 5.6 indica la generazione. Sol, Terra e Luna sono livelli di capacità che possono migliorare ciascuno secondo i propri tempi. Per la maggior parte delle aziende Terra è la scelta di default più sensata, e si passa a Sol o Luna solo quando il lavoro lo richiede davvero.

Se questa settimana hai cercato GPT-5.6, probabilmente ti sei imbattuto in tre nomi sconosciuti e in una tabella di prezzi, e ne sei uscito più confuso di prima. Ecco la versione semplice. OpenAI ha smesso di rilasciare un solo modello per versione e ha iniziato a rilasciare una piccola famiglia. Il lancio è avvenuto il 9 luglio dopo un breve ritardo legato a una revisione di sicurezza del governo statunitense, ed è ora disponibile in ChatGPT, in Codex e tramite le API.

Il cambiamento importante non sono i punteggi grezzi nei benchmark. È che ora devi fare una scelta che prima non dovevi fare: quale livello si adatta a quale compito. Se azzecchi la scelta spendi meno ottenendo risposte migliori. Se sbagli, o paghi troppo per compiti semplici oppure mandi compiti difficili a un modello troppo piccolo. Questo articolo spiega a cosa serve ogni livello, quanto costa e come decidere.

Cosa ha rilasciato davvero OpenAI

GPT-5.6 è una generazione di modello offerta in tre dimensioni. OpenAI descrive così la denominazione: il numero indica la generazione, e il nome (Sol, Terra, Luna) indica il livello di capacità. Un livello può avanzare secondo i propri ritmi, quindi un futuro Terra potrebbe diventare più intelligente senza che tutta la famiglia salti a un nuovo numero di versione. Sembra marketing, ma ha un effetto pratico. Scegli un livello per un compito e ci resti quasi sempre, invece di dover ritestare ogni modello a ogni rilascio.

Ecco per cosa è pensato ciascuno.

Sol, il modello di punta

Sol è il modello per le cose difficili. Ragionamento di frontiera, lavoro da agente a lungo orizzonte che si svolge su molti passaggi, programmazione seria e problemi scientifici o analitici dove una risposta sbagliata costa cara. Se stai costruendo un agente che pianifica ed esegue un compito in più fasi da solo, o se ti serve la migliore risposta possibile su una domanda davvero complessa, questo è il livello giusto. OpenAI fa girare Sol anche su hardware Cerebras fino a 750 token al secondo, cosa che conta se vuoi qualità di frontiera senza lunghe attese.

Terra, il cavallo da lavoro quotidiano

Terra è quello che la maggior parte dei team userà quasi sempre. OpenAI lo posiziona come sostanzialmente pari al precedente GPT-5.5 in qualità, ma a un costo circa dimezzato. Per scrivere bozze, riassumere, rispondere alle domande dei clienti, classificare i ticket e per la generalità dei compiti aziendali quotidiani, Terra è abbastanza veloce, abbastanza intelligente e con un prezzo tale da non farti pensare alla bolletta ogni volta che qualcuno esegue una query.

Luna, il livello per i volumi

Luna è il più veloce ed economico dei tre. È costruito per grandi volumi e bassa latenza: classificazione semplice, risposte brevi, tagging, instradamento, filtraggio di primo livello, tutto ciò che esegui migliaia di volte al giorno e dove ogni singola chiamata è facile. Non affideresti a Luna la tua analisi più difficile, ma per la lunga coda di piccole chiamate ripetitive tiene bassi i costi e veloci le risposte.

Quanto costa

I prezzi sono per milione di token, suddivisi tra input (ciò che invii) e output (ciò che il modello scrive in risposta). Un token equivale circa a tre quarti di parola, quindi un milione di token è tantissimo testo, ma su larga scala la somma cresce in fretta.

  • Sol: $5 per milione di token in input, $30 per milione di token in output.
  • Terra: $2.50 per milione di token in input, $15 per milione di token in output.
  • Luna: $1 per milione di token in input, $6 per milione di token in output.

Il divario è tutto il punto. Sol costa cinque volte Luna sull'input e cinque volte sull'output. Mandare a Sol un compito che Luna potrebbe gestire non è un piccolo spreco, è uno spreco moltiplicato per cinque, ripetuto a ogni chiamata. È esattamente per questo che la suddivisione in livelli conta per chi usa questi modelli a volumi reali.

C'è anche un cambiamento più discreto che fa risparmiare, se lo sfrutti: il prompt caching è migliorato. GPT-5.6 ti permette di impostare punti di interruzione espliciti nella cache e mantiene un prompt in cache attivo per almeno 30 minuti. La lettura dalla cache mantiene lo sconto del 90 per cento sull'input, mentre la scrittura costa 1,25 volte la normale tariffa di input. In parole povere, se invii più e più volte le stesse istruzioni o lo stesso contesto lungo, la cache fa sì che tu paghi il prezzo pieno per memorizzarlo una volta e una frazione del prezzo a ogni riutilizzo nella mezz'ora successiva.

Quale livello dovrebbe usare la tua azienda

Non scegliere un unico livello per tutto. Il senso di una famiglia è che instradi ogni compito verso il livello più economico in grado di svolgerlo bene. Un modo semplice per decidere:

  1. Parti da Terra. Per la maggior parte dei compiti aziendali è il giusto equilibrio tra qualità e costo. Rendilo il tuo default e abbandonalo solo se hai un motivo.
  2. Sposta un compito verso Sol quando Terra fa visibilmente fatica: flussi di lavoro da agente in più fasi, analisi complesse, codice che deve essere corretto, o qualsiasi cosa in cui una risposta sbagliata costa soldi veri. Testalo, verifica che la risposta migliore valga il prezzo più alto, poi tienilo lì.
  3. Sposta un compito verso Luna quando è semplice e lo esegui di continuo: taggare email, instradare ticket, risposte brevi e standard, filtraggio. I risparmi sono massimi proprio dove il volume è più alto.

Non devi tirare a indovinare in astratto. Prendi un flusso di lavoro reale, eseguilo su due livelli e confronta output e costo fianco a fianco. La risposta giusta di solito è ovvia dopo un pomeriggio di test, ed è diversa per compiti diversi. È in quell'instradamento per compito che si trova il risparmio. Abbiamo scritto di più su come controllare questo tipo di spesa nella nostra guida su come tagliare i costi dell'IA aziendale nel 2026.

L'altra cosa uscita: ChatGPT Work

Insieme ai modelli, OpenAI ha rilasciato un agente pensato per il lavoro all'interno di ChatGPT e ha rafforzato i controlli per gli account aziendali. Gli amministratori dei piani Business, Enterprise ed Edu possono definire politiche su quali modelli, strumenti e connettori il personale può usare, e mettere un tetto all'uso. Se stai portando l'IA in un intero team piuttosto che a un singolo utente esperto, sono proprio quei controlli la parte a cui prestare attenzione. Sono ciò che ti permette di mantenere prevedibile un'adozione aziendale, invece di avere tutti che usano quello che preferiscono con qualsiasi budget.

Se stai confrontando le opzioni invece di legarti a un solo fornitore, vale la pena leggere di questi modelli accanto alle alternative. Abbiamo trattato un altro rilascio recente nella nostra guida a Claude Fable 5 per le aziende, e la mossa sensata per la maggior parte delle imprese non è la fedeltà a un solo laboratorio, ma scegliere il modello giusto per ogni compito.

Dovresti passare a GPT-5.6 subito?

Se costruisci già su OpenAI, passare da GPT-5.5 a Terra è un aggiornamento semplice da testare, dato che Terra punta a eguagliare il modello precedente a un prezzo più basso. C'è un risparmio concreto sul tavolo già solo con questo cambio, una volta che hai verificato che la qualità regga sui tuoi compiti. Se sei su un modello concorrente e funziona, non c'è fretta. Un nuovo rilascio è un motivo per fare un rapido confronto, non per buttare via qualcosa che già svolge il lavoro. L'approccio costante batte l'inseguimento di ogni lancio: testa sul tuo carico di lavoro reale, tieni ciò che vince e instrada per compito invece che per clamore.

Domande frequenti

Qual è la differenza tra Sol, Terra e Luna?

Sono tre dimensioni della stessa generazione GPT-5.6. Sol è il più capace e il più costoso, costruito per il ragionamento complesso e i lunghi compiti da agente. Terra è il modello equilibrato di tutti i giorni, a circa metà del costo. Luna è il più veloce ed economico, pensato per grandi volumi e compiti semplici.

Quando è uscito GPT-5.6?

OpenAI lo ha presentato in anteprima il 26 giugno 2026 e ha reso tutti e tre i livelli disponibili in via generale il 9 luglio 2026, dopo un breve ritardo legato a una revisione di sicurezza del governo statunitense. È disponibile in ChatGPT, in Codex e tramite le API.

Quanto costa GPT-5.6?

Per milione di token: Sol costa $5 in input e $30 in output, Terra costa $2.50 in input e $15 in output, e Luna costa $1 in input e $6 in output. Il prompt caching può abbassare ulteriormente il costo effettivo se riutilizzi spesso lo stesso contesto.

Quale livello è meglio per una piccola impresa?

Parti da Terra per la maggior parte del lavoro. Sposta compiti specifici verso Sol solo quando sono davvero difficili, e verso Luna quando sono semplici e girano a volumi elevati. Instradare per compito, invece di scegliere un unico livello per tutto, è il modo per tenere alta la qualità e basso il costo.

Devo per forza passare da GPT-5.5?

No, ma vale la pena testare Terra, dato che punta a eguagliare la qualità di GPT-5.5 a un prezzo più basso. Provalo prima sui tuoi compiti e passaci solo se la qualità regge e il risparmio è reale per te.

Cos'è il prompt caching e perché conta?

Se invii ripetutamente le stesse istruzioni o lo stesso contesto lungo, la cache lo memorizza così non paghi il prezzo pieno ogni volta. GPT-5.6 mantiene un prompt in cache per almeno 30 minuti e offre uno sconto del 90 per cento sull'input in cache, il che riduce la bolletta per i carichi di lavoro ripetitivi.

Ti serve aiuto per scegliere e configurare tutto questo?

Buinsoft è una società di consulenza su IA e software con sede a Praga. Aiutiamo le aziende a testare questi modelli sul loro lavoro reale, a instradare ogni compito verso il livello più adatto e a impostare gli accessi e i controlli di costo prima di un'adozione, non dopo la prima bolletta a sorpresa.

Scrivici a info@buinsoft.com oppure usa il modulo di contatto, e ti aiuteremo a scegliere il modello giusto per ogni compito.

Dettagli aggiornati al 10 luglio 2026. I prezzi e la disponibilità dei modelli possono cambiare, quindi controlla la documentazione attuale di OpenAI prima di decidere.

Related articles