OpenAI presenta GPT-6 Sol e Luna: più AI, meno costi

I nuovi modelli portano le capacità di Astra a costi inferiori, con miglioramenti nel coding, nel lavoro professionale e nell’affidabilità

Redazione

OpenAI amplia la nuova generazione dei suoi modelli AI con GPT-6 Sol e GPT-6 Luna, due sistemi pensati per portare parte delle capacità introdotte con GPT-6 Astra a un numero maggiore di attività, con un’attenzione particolare a prestazioni, velocità e costi.

L’obiettivo è rendere l’AI avanzata più accessibile anche per attività quotidiane e applicazioni su larga scala. Per questo OpenAI ha lavorato sia sull’efficienza dei modelli sia sulle infrastrutture necessarie a utilizzarli, arrivando a dimezzare i prezzi API di Sol e Luna rispetto ai prezzi promozionali di GPT-5.6.

GPT-6 Sol e Luna costano la metà

La riduzione dei costi rappresenta uno degli elementi centrali del lancio. Per GPT-6 Sol, il prezzo dell’input passa da 4 a 2 dollari per milione di token, mentre quello dell’output scende da 20 a 10 dollari.

Per GPT-6 Luna, invece, l’input passa da 0,20 a 0,10 dollari per milione di token e l’output da 1,20 a 0,50 dollari. In entrambi i casi OpenAI indica quindi una riduzione del 50% rispetto ai prezzi promozionali dei modelli precedenti.

GPT-6 Astra rimane invece il modello di punta della famiglia, destinato ai progetti che richiedono il massimo livello di prestazioni. Sol e Luna occupano una fascia più orientata all’equilibrio tra capacità e costo.

Più prestazioni nel lavoro professionale

Secondo OpenAI, GPT-6 Sol è stato progettato per affrontare attività professionali complesse, lasciando maggiore spazio alle iterazioni grazie a limiti di utilizzo più elevati e costi inferiori.

Nei test AutomationBench, dedicati ai flussi di lavoro aziendali attraverso diverse applicazioni, GPT-6 Sol con il massimo livello di ragionamento raggiunge un punteggio superiore a quello di Claude Opus 5 al massimo livello, con un costo per attività pari al 9% di quello indicato per il modello concorrente. GPT-6 Luna, invece, migliora di 5,4 punti percentuali rispetto a GPT-5.6 Luna, con un costo per attività inferiore del 58%.

Anche nel benchmark Agents’ Last Exam, che valuta attività professionali complesse e di lunga durata, GPT-6 Sol raggiunge il 56,4%, con un costo per attività inferiore del 60% rispetto al valore più alto registrato da Claude Opus 5 nel test.

Migliorano affidabilità, coding e uso del computer

OpenAI segnala progressi anche sul fronte della fattualità. Nei test interni basati su conversazioni reali anonimizzate in cui gli utenti avevano segnalato errori, GPT-6 Sol commetterebbe circa la metà degli errori del predecessore, avvicinandosi ai risultati di Astra. GPT-6 Luna migliora a sua volta e, con livelli di ragionamento più elevati, raggiunge le prestazioni di GPT-5.6 Sol a circa un centesimo del costo.

Sul coding, GPT-6 Sol migliora sensibilmente rispetto a GPT-5.6 Sol nel benchmark FrontierCode. Nel test DeepSWE, inoltre, Sol al massimo livello raggiunge il 68,8%, a 1,1 punti dal 69,9% ottenuto da Claude Fable 5 al livello xhigh, ma con un costo per attività indicato come circa l’80% inferiore. Luna arriva invece al 66,6%, con costi per attività inferiori del 93% rispetto a Claude Opus 5 e del 96% rispetto a Fable 5.

Anche l’uso del computer beneficia del nuovo approccio. Su OSWorld 2.0, GPT-6 Sol raggiunge il 60,5%, contro il 60,3% di Claude Opus 5 a un diverso livello di ragionamento, con un costo per attività inferiore di circa l’80%.

Risposte più chiare e maggiore efficienza nella cache

OpenAI ha lavorato anche sullo stile di collaborazione. Sol e Luna ereditano da Astra una comunicazione più chiara, con meno gergo, meno formulazioni insolite e meno dettagli considerati di scarso valore, oltre a risposte leggermente più brevi senza ridurre la sostanza.

Per gli sviluppatori arrivano inoltre miglioramenti al prompt caching, con tassi di riutilizzo della cache più elevati e sconti del 90% sui token di input memorizzati nella cache. Sono stati introdotti anche strumenti per monitorare le prestazioni della cache e maggiore controllo sui prefissi da memorizzare.

GPT-6 Sol e Luna mostrano infine miglioramenti rispetto ai predecessori nelle valutazioni di allineamento, compresa una riduzione delle affermazioni fuorvianti relative al lavoro svolto nel coding.

I due modelli sono disponibili in ChatGPT Work e Codex per gli utenti Plus, Pro, Business, Enterprise ed Edu. Gli utenti Free e Go possono accedere a GPT-6 Luna nell’app desktop. Nell’API sono disponibili con i nomi gpt-6-sol e gpt-6-luna, mentre il rollout in ChatGPT procede gradualmente.

Iscriviti alla newsletter

Non inviamo spam! Leggi la nostra Informativa sulla privacy per avere maggiori informazioni.