OpenAI lancia GPT-6 Sol e Luna: intelligenza frontier a metà prezzo

OpenAI ha appena rilasciato due nuovi modelli della famiglia GPT-6: Sol e Luna. L’obiettivo è portare l’intelligenza di Astra — il loro modello più potente — a chi non ha budget illimitati o non vuole aspettare secondi preziosi per ogni risposta.

Astra resta il campione assoluto. Ma quanti progetti reali hanno davvero bisogno di tutto quel firepower? La maggior parte del lavoro quotidiano si svolge su scale diverse, con ritmi diversi, e — diciamocelo — budget molto diversi.

Metà prezzo, stessa generazione

Il taglio è netto: -50% sui prezzi API rispetto ai modelli GPT-5.6. Sol passa da 4$ a 2$ per milione di token in input, da 20$ a 10$ in output. Luna da 0,20$ a 0,10$ in input, da 1,20$ a 0,50$ in output. Cifre che fanno la differenza quando l’uso diventa intensivo.

Non è solo una questione di listino. OpenAI ha migliorato caching e inference, il che significa meno elaborazione per ottenere gli stessi risultati. Il risparmio viene scaricato direttamente sugli utenti.

Sol batte Opus 5 al 9% del costo

Su AutomationBench — un test che simula workflow aziendali reali attraverso 47 strumenti — GPT-6 Sol in modalità xhigh segna 33,2%. Claude Opus 5 al massimo sforzo? 26,9%. Il costo per task di Sol è circa il 9% di quello di Opus 5.

Anche Claude Fable 5.1 — con fallback a Opus 5 nel 40% dei casi — viene superato da Sol a una frazione del costo. Task complessi: vendite, marketing, operazioni, supporto, finanza, HR. Roba vera, non benchmark giocattolo.

Affidabilità fattuale raddoppiata

Su questo fronte GPT-6 Sol fa metà degli errori del predecessore, avvicinandosi all’affidabilità di Astra a costi molto inferiori. Luna ai livelli di effort più alti raggiunge la precisione del vecchio Sol a un centesimo del prezzo.

La valutazione si basa su conversazioni reali in cui gli utenti avevano segnalato errori fattuali. Non è rappresentativa dell’uso tipico — dove gli errori sono più rari — ma è un buon stress test.

Coding: meno chiacchiere, più sostanza

Anche lo stile comunicativo è migliorato. OpenAI lo chiama “improved collaboration style”: meno giri di parole, meno gergo inutile, risposte più corte senza perdere sostanza.

L’esempio che mostrano è illuminante. Stessa richiesta — aggiungere un design bento-box e uno slider a un sito — ottiene da GPT-5.6 Sol una risposta piena di ovvietà (“il sito ha quattro pagine”), dettagli implementativi non richiesti (il prompt usato per generare le immagini), e frasi vaghe tipo “bento feel”. GPT-6 Sol va dritto al punto: cosa ha fatto, cosa ha controllato, cosa non serviva (React, in questo caso).

Su FrontierCode — che valuta se il codice è pronto per il merge in codebase reali — Sol migliora nettamente rispetto al predecessore e pareggia Fable 5.1 xhigh a costi molto inferiori. Su DeepSWE v1.1, che testa task complessi di software engineering, Sol al massimo effort arriva al 68,8%, a un punto scarso dal miglior risultato di Fable 5 (69,9%) ma con l’80% di costo in meno per task.

Caching potenziato per agenti e conversazioni lunghe

OpenAI ha migliorato il prompt caching — il meccanismo che permette di riutilizzare parti di contesto già elaborate. Cache hit rate più alti di default, risposte più veloci, e sconti del 90% sui token di input già in cache.

GitHub ha confermato che negli ultimi mesi questi miglioramenti hanno ridotto di oltre il 50% la quota di token che richiedono elaborazione fresca, su miliardi di richieste, facendo rispondere Copilot più in fretta.

Gli sviluppatori possono ora regolare reasoning effort e disponibilità di tool senza invalidare la cache. Prima, ogni modifica a questi parametri azzerava il contesto salvato.

Uso interno esplosivo

Dentro OpenAI l’uso quotidiano degli agenti di coding è esploso. Valutato a prezzi API, il consumo medio giornaliero di token è di 600$ per il ricercatore mediano. Al 90° percentile: 7.000$ al giorno. Cifre che danno l’idea di quanto questi strumenti siano diventati centrali nel lavoro vero.

Disponibilità

GPT-6 Sol e Luna sono disponibili da oggi in ChatGPT Work e Codex per utenti Plus, Pro, Business, Enterprise ed Edu. Gli utenti Free e Go possono accedere a Luna nell’app desktop. Nelle API OpenAI i modelli si chiamano gpt-6-sol e gpt-6-luna.

Il rollout in ChatGPT sarà graduale nel corso della giornata. Se non vedete i nuovi modelli, riprovate più tardi.

Nota: tutte le valutazioni di GPT-6 sono state eseguite in ambiente di ricerca o via API, il che può produrre output leggermente diversi dalla produzione di ChatGPT per differenze nei prompt di sistema e negli strumenti disponibili. I punteggi dei competitor vengono da report pubblici.

AI LABELS_3x2_3_black