OpenAI ha scelto di presentare in anteprima a un gruppo selezionato di partner, 3 nuove versioni della propria famiglia di modelli GPT-5.6, ciascuna pensata per un pubblico e un caso d’uso specifico.
In questo caso parliamo di Sol Terra e Luna, tre distinte varianti di GPT 5.6 che vogliono arrivare in un momento in cui la competizione con Anthropic è serrata nel campo dei modelli linguistici avanzati legati al codice. All’interno di questo articolo vedremo più nel dettaglio come funzionano e a chi si riferiscono questi tre modelli e perché potrebbero cambiare le carte in tavola per tantissime cose, compresi i professionisti del codice che lavorano per le piattaforme del gioco online.
Tre modelli per tre pubblici tutti diversi
Secondo quanto dichiarato, Sol sarà il vertice della nuova rappresenta il vertice della nuova offerta OpenAI, con prestazioni dichiarate dell’88,8% di successo nella scrittura di codice, percentuale che sale addirittura al 91,9% quando il modello viene utilizzato nella modalità denominata Ultra, pensata per i compiti di programmazione più complessi.
Terra, invece, è il modello pensato per un utilizzo più quotidiano e punta sull’avere un rapporto qualità-prezzo più accessibile. Le prestazioni saranno paragonabili a ChatGPT-5.5 ma i costi di utilizzo saranno dimezzati rispetto al modello di punta, risultando quindi ideale per gli sviluppatori con budget più contenuti.
Luna, infine, sarà il modello che si pone come compromesso intermedio, risultando ideale per chi cerca un equilibrio tra le prestazioni elevate e il costo più basso possibile, perfetto quindi per integrazioni su larga scala dove il costo per richiesta pesa molto.
I benchmark pubblicati da OpenAI sembrano comunque particolarmente promettenti: Sol, infatti, ha ottenuto risultati davvero interessanti su ExploitGym, uno strumento sviluppato internamente dall’azienda in collaborazione con l’università di Berkley e specificatamente pensato per valutare le capacità dei modelli linguistici in ambito di sicurezza informatica. Il futuro dei tavoli verdi che permettono le puntate da 21 + 3 blackjack, oltre a quelli tradizionali, potrà essere ancor più privo di bug rispetto a quanto siamo abituati in questo specifico momento.
Cosa vuole fare OpenAI rispetto ad Anthropic?
Il confronto diretto con la concorrenza è al centro della comunicazione di OpenAI.
Secondo i comunicati rilasciati dalla compagnia, Sol supererebbe di poco Claude Mythos di Anthropic nella scrittura di codice, mentre Terra risulterebbe essere un modello con prestazioni paragonabili a Claude Fable 5.
Se parliamo di cybersicurezza, Sol otterrebbe risultati identici a quelli di Mythos impiegando però soltanto un terzo dei token necessari per un dato compito, segno della maggiore efficienza computazionale dello strumento di OpenAI.
Quanto conta, in un mercato tanto competitivo, la trasparenza normativa oltre alle sole prestazioni tecniche? OpenAI ha sottolineato di aver mostrato questi modelli alle autorità prima del lancio, in linea con gli impegni presi con il governo statunitense, distinguendosi da Anthropic che invece durante il corso degli scorsi mesi ha invece dovuto affrontare alcune restrizioni imposte dal Dipartimento del Commercio.
È ancora però difficile capire come, nel pratico, questi vantaggi si tradurranno: se i dati forniti dalla stessa OpenAI si tradurranno come evidenti migliorie del quotidiano per gli sviluppatori, la compagnia sembrerà aver vinto questa piccola sfida, almeno fino al prossimo modello di Dario Amodei e soci.