Ieri Anthropic ha presentato Claude Opus 5.5. Poche ore dopo OpenAI ha lanciato GPT-6 Sol e Luna. I capi delle due aziende chiedono regole, standard di sicurezza e prudenza nello sviluppo dell’intelligenza artificiale. Poi, appena finita la frase, arriva un altro modello. Il rallentamento, per ora, è più nelle parole che nei fatti. Nessuno accenna decellera ma tutti o quasi alzano la mano per chiedere aiuto. O chiedere tempo in attesa di avere fondamentali più solidi. Forse.
Ciòdetto per capire cosa cambia con GPT-6 conviene partire dalla famiglia. Astra, presentato all’inizio del mese, è il modello di punta: OpenAI lo propone per il lavoro complesso, dalla scrittura di codice all’uso del computer e delle applicazioni aziendali. Sol porta parte di quelle capacità nei compiti impegnativi ma più frequenti. Luna è la versione leggera, pensata per svolgere grandi volumi di attività a costi contenuti. Tutti e tre possono lavorare con strumenti; Astra resta quello da chiamare quando il problema richiede più risorse.
La novità più facile da misurare è il prezzo. Nelle API, per un milione di token, Sol costa 2 dollari in ingresso e 10 in uscita; Luna 10 e 50 centesimi. OpenAI parla di un taglio del 50% rispetto ai prezzi promozionali dei corrispondenti GPT-5.6. È una differenza concreta per chi affida all’IA migliaia di richieste al giorno: se ogni risposta costa meno, diventano sostenibili più tentativi, controlli e passaggi di lavoro.
Cambia anche il comportamento che OpenAI promette. Sol e Luna riprendono da Astra miglioramenti nell’uso del computer, nella programmazione e nel rispetto delle istruzioni. Sol, secondo un test interno dell’azienda costruito su conversazioni in cui gli utenti avevano segnalato errori, commette circa la metà degli errori fattuali del predecessore.
Sul fronte delle prestazioni, GPT-6 Sol e Luna segnano un netto cambio di passo nell’efficienza computazionale più che nella pura forza bruta: ereditano dall’architettura Astra la capacità di gestire flussi di lavoro agentici, programmazione complessa e interazione diretta con i sistemi operativi (computer-use), ma con una latenza sensibilmente ridotta, un dimezzamento delle allucinazioni rispetto alla generazione 5.x e una sintesi di ragionamento che richiede una frazione dei token di output precedentemente necessari.




-U88240761686NFm-1440x752@IlSole24Ore-Web.jpg?r=1170x507)




-U87237461882aeY-1440x752@IlSole24Ore-Web.jpg?r=1170x507)



