Il 29 settembre 2026 OpenAI ha presentato GPT-6.1 Sol come aggiornamento di GPT-6 Sol, pensato per la programmazione agentica, l’uso del computer e il lavoro professionale. Per chi sviluppa, i dati concreti sono una finestra di contesto API da 1.050.000 token, un massimo di 128.000 token in uscita e tariffe standard a consumo. Le prestazioni citate dall’azienda, invece, dipendono dal test e dal livello di ragionamento usati.

OpenAI presenta GPT-6.1 Sol come aggiornamento di GPT-6 Sol

GPT-6.1 Sol è un modello di ragionamento che OpenAI propone per attività di coding svolte con agenti, interazione con il computer e lavoro professionale. Nell’API il suo identificativo è gpt-6.1-sol. La finestra di contesto — la quantità di token che il modello può considerare in una richiesta — arriva a 1.050.000 token; la risposta può raggiungere un massimo di 128.000 token.

Che cosa mostrano i test citati da OpenAI

OpenAI riporta risultati diversi a seconda della prova. Su DeepSWE v1.1, un benchmark di attività di ingegneria del software, GPT-6.1 Sol raggiunge un risultato pari a quello di GPT-6 Astra a circa un quinto del costo. Su AutomationBench 1.0.6, con il livello di ragionamento medio, supera Claude Opus 5.5 di 2,2 punti percentuali e costa all’incirca un terzo per attività.

Test e condizioneRisultato riportato per GPT-6.1 SolModello di confrontoCosto per attività
DeepSWE v1.1Risultato pari a quello del modello di confrontoGPT-6 AstraCirca un quinto del costo di GPT-6 Astra
AutomationBench 1.0.6, ragionamento medio2,2 punti percentuali sopra il modello di confrontoClaude Opus 5.5Circa un terzo del costo di Claude Opus 5.5

Sono risultati dichiarati da OpenAI per questi benchmark: descrivono il confronto nelle condizioni indicate, non un esito garantito su ogni progetto. Per un approfondimento sul modello usato nel primo confronto, c’è anche la nostra analisi di GPT-6 Astra.

Le valutazioni di sicurezza nel loro contesto

Nella classificazione di sicurezza di OpenAI, GPT-6.1 Sol è valutato come critico per la cybersecurity, alto per le capacità biologiche e chimiche e sotto la soglia alta per l’auto-miglioramento dell’IA. OpenAI afferma di applicare al modello lo stesso insieme di salvaguardie adottato per GPT-6 Astra.

Il documento di valutazione riporta anche risultati specifici su prove impegnative: la percentuale di rappresentazioni ingannevoli nel coding è dell’1,50% per Sol e dello 0,51% per GPT-6 Astra; nei test sulla persistenza indesiderata, Sol registra il 23,5% dei tentativi contro il 17,4% di Astra. OpenAI precisa che queste prove sono progettate per sollecitare comportamenti problematici e non rappresentano i tassi d’uso tipici. Il test sulla persistenza riguarda soprattutto restrizioni a basso rischio e non comprende i controlli di sistema pensati per impedirne l’elusione.

Accesso, API e tariffe pubblicate

OpenAI ha annunciato l’accesso a GPT-6.1 Sol tramite API e in ChatGPT Work e Codex per gli utenti idonei dei piani Pro, Plus, Business, Enterprise ed Edu. Le note di rilascio datano al 29 settembre l’avvio del rollout con gli utenti Pro e indicano l’estensione agli altri piani. Al momento dell’annuncio, il modello non era ancora disponibile nella modalità Chat standard.

Le tariffe API standard pubblicate, espresse in dollari USA, sono 2 dollari per milione di token in ingresso, 0,10 per milione di token in ingresso memorizzati nella cache, 2,50 per milione di token nelle scritture in cache e 10 per milione di token in uscita. Per richieste con più di 272.000 token in ingresso, le tariffe di input e cache raddoppiano e quella di output aumenta di 1,5 volte per l’intera richiesta.

Il modello accetta testo e immagini in ingresso e restituisce testo; non supporta audio e video. Per le chiamate agli strumenti, OpenAI indica la Responses API: Chat Completions è supportata senza tool calling. I livelli di ragionamento disponibili sono low, medium (predefinito), high, xhigh e max.

Dots è una funzione separata per gli agenti

OpenAI ha presentato Dots come una funzione distinta: agenti sempre attivi, alimentati da GPT-6 Astra, con un proprio computer cloud. Gli agenti svolgono attività continuative e restituiscono risultati che l’utente può esaminare.

L’accesso al lancio dipende da piano e area geografica. Gli utenti Pro e Business Premium possono accedere nei mercati supportati; per Enterprise, Edu e Healthcare è prevista una beta attivabile dall’amministratore. L’accesso Pro al lancio escludeva lo Spazio economico europeo, la Svizzera e il Regno Unito, quindi anche l’Italia. Per le altre novità di DevDay dedicate a Codex e alle API, è disponibile il nostro riepilogo.