OpenAI ha appena annunciato un taglio di prezzo che fa girare la testa. GPT-5.6 Luna, il modello più veloce ed economico della famiglia, costa ora l’80% in meno. Sì, avete letto bene: otto-zero percento. GPT-5.6 Terra, il modello bilanciato per il lavoro quotidiano, scende del 20%. Non è un’offerta promozionale — è il nuovo listino.
Il motivo? GPT-5.6 ha letteralmente aiutato a ottimizzare se stesso. Come raccontato ieri da OpenAI, Sol (la versione più potente) ha riscritto autonomamente i kernel di produzione, progettato centinaia di esperimenti per migliorare la generazione di token e monitorato il training intervenendo quando necessario. Il risultato: costo di serving ridotto del 20%, efficienza di generazione aumentata del 15%. E adesso questi guadagni arrivano direttamente ai clienti.
Luna: intelligenza troppo economica per essere misurata
Michele Catasta di Replit non usa mezzi termini: ‘GPT-5.6 Luna è la cosa più vicina all’intelligenza troppo economica per essere misurata che abbiamo mai visto. Non ho mai visto un modello così economico essere così potente’. E i numeri gli danno ragione. Luna offre prestazioni paragonabili a modelli che erano frontier-class un anno fa — a circa 6 centesimi di dollaro per task. Quasi nove volte più veloce. Su lavori professionali misurati con Agents’ Last Exam, Luna supera Fable 5 con un costo stimato per task inferiore del 99%. Novantanove. Percento.
Cosa significa in pratica? Che volumi di lavoro che prima non erano economicamente sostenibili diventano improvvisamente fattibili. Analisi massiccia di documenti, classificazione di interazioni cliente, implementazione di routine — tutto diventa scalabile. Sid Pardeshi di Blitzy riporta che Luna gestisce 2,2 volte più contesto con 8,5 volte meno token in output, a un costo inferiore dell’87% rispetto a GPT-5.4 mini. In produzione, con migliaia di chiamate reali.
Terra e la nuova economia dell’AI quotidiana
Terra non fa numeri altrettanto esplosivi ma rimane il cavallo di battaglia per il lavoro di ogni giorno. Hoda Noorian di Notion spiega: ‘Nelle nostre valutazioni, ha fornito qualità comparabile a GPT-5.5 a metà del costo per task e nel 60% di tempo in meno’. Per contesti dove la latenza conta — Q&A su workspace, task con scope definito — Terra trova il suo punto di equilibrio.
Il nuovo prezzo: 2 dollari per milione di token in input, 12 dollari per milione in output. Luna scende a 0,20 dollari in input e 1,20 in output. Sol rimane invariato. I prezzi degli abbonamenti ChatGPT e Codex non cambiano, ma Terra e Luna consumano meno crediti — che tradotto significa: fate più lavoro con lo stesso budget.
Fast mode: quando il tempo vale il doppio
Per chi ha fretta, OpenAI introduce Fast mode nell’API, sostituendo l’offerta Priority Processing. Per GPT-5.6 Sol, Fast mode consegna velocità fino a 2,5 volte superiori rispetto allo Standard processing — al doppio del prezzo, ma senza cambiamenti in intelligenza. Le richieste esistenti taggate ‘priority’ funzioneranno automaticamente con Fast mode. Compatibilità retroattiva, nessun problema di migrazione.
Efficienza su ogni strato
Il vantaggio competitivo di OpenAI non viene solo dai modelli. Viene dall’intero stack: i modelli stessi, i sistemi di inferenza che li eseguono, l’harness agenticо che li connette a strumenti e contesto. GPT-5.6 prende percorsi più diretti attraverso il lavoro. Il routing migliore mantiene l’hardware produttivo, il software di produzione ottimizzato genera token più efficientemente, la gestione intelligente del contesto aiuta gli agenti a evitare di ripetere lavoro già completato.
E qui arriva la parte interessante: GPT-5.6 Sol sta aiutando OpenAI a trovare il prossimo round di miglioramenti. In un processo guidato da umani, Sol riscrive autonomamente kernel, progetta esperimenti, monitora training. È un loop di feedback che si stringe: modelli più capaci accelerano la capacità di migliorare l’efficienza. Che a sua volta produce modelli migliori. E così via.
Strategia di compute per la scala
Soddisfare la domanda di intelligenza abbondante richiede più compute — e compute più produttivo. OpenAI sta costruendo un portfolio infrastrutturale resiliente e abbinando ogni workload ai sistemi più adatti. L’approccio supporta entrambe le estremità della curva prezzo-prestazioni. All’estremità low-cost, i nuovi prezzi di Luna e Terra rendono economico il lavoro ad alto volume su scala molto maggiore. All’estremità frontier, Fast mode dà ai clienti API accesso più rapido a Sol quando il tempo di risposta è importante.
Le aziende possono spostare più AI nelle operazioni quotidiane senza sacrificare velocità sul lavoro più conseguente. I guadagni possono accumularsi. Stanislas Polu di Dust conferma: ‘Dati gli stessi task agentici, GPT-5.6 Luna è il 40% più veloce e il 40% più economico del nostro modello predefinito precedente’.
Disponibilità e prezzi
GPT-5.6 Terra e Luna restano disponibili in ChatGPT Work, Codex e OpenAI API. In ChatGPT Work e Codex, gli utenti Free e Go possono accedere a Terra, mentre gli utenti Plus, Pro, Business ed Enterprise possono scegliere Terra e Luna. I nuovi prezzi API partono dal 30 luglio. Il rollout su AWS inizia oggi stesso.
La missione dichiarata di OpenAI è rendere l’AGI a beneficio di tutta l’umanità. Rendere l’intelligenza avanzata più abbondante e accessibile economicamente è centrale a quella missione. Questi cambiamenti mettono quell’impegno in pratica — e riflettono anni di miglioramenti in come i modelli vengono costruiti, serviti e messi al lavoro. Ora tocca alle aziende vedere fino a dove possono spingersi con questi nuovi margini.
