Il 29 settembre 2026, al DevDay, OpenAI ha presentato GPT-6.1 Sol, un aggiornamento di GPT-6 Sol che secondo l'azienda si avvicina a GPT-6 Astra nella programmazione agentica, nell'uso del computer e nel lavoro professionale, a circa un quinto del prezzo. Non è il modello più potente della famiglia, ma è quello che rende conveniente usare l'intelligenza artificiale di fascia alta in prodotti reali.
Cosa cambia rispetto ad Astra e a GPT-6 Sol
GPT-6 Astra è il modello di punta, introdotto il 3 settembre. Sol è la versione più veloce ed economica della stessa famiglia, e con la 6.1 migliora in tre aree:
- Programmazione agentica: pianificare, modificare, testare e iterare su un intero progetto software
- Uso del computer: maggiore affidabilità nel muoversi tra interfacce reali
- Lavoro professionale: analisi, scrittura e compiti articolati in più passaggi
Prezzi
Nell'API il costo di GPT-6.1 Sol è di 2 dollari per milione di token in input e 10 dollari per milione in output. L'input in cache scende a 0,10 dollari: il 95% in meno rispetto all'input standard e il 50% in meno rispetto alla cache di GPT-6 Sol.
Per confronto, GPT-6 Astra costa 10 e 50 dollari per milione di token: da qui il rapporto di circa uno a cinque.
Benchmark: vicino ad Astra, non sopra
La parte più interessante è il costo per singolo compito:
| Test | GPT-6.1 Sol | GPT-6 Astra | GPT-6 Sol |
|---|---|---|---|
| DeepSWE v1.1 (progetti software reali) | 75,2% (circa 1,50 $ a compito) | 74,8% (circa 7,70 $) | 68,8% |
| OSWorld 2.0 (uso del computer) | 71,4% (circa 1,30 $) | 73,5% (circa 9,30 $) | 64,4% |
Su DeepSWE Sol eguaglia Astra con un costo per compito circa cinque volte più basso e supera GPT-6 Sol di 6,4 punti percentuali. Sull'uso del computer, invece, Astra resta davanti. Si registra inoltre un calo delle allucinazioni del 32% a basso sforzo di ragionamento (7,7% contro 11,4% di GPT-6 Sol).
Un avvertimento: sono numeri dichiarati e rielaborati, e cambiano di qualche decimale a seconda di chi li misura (per Astra su DeepSWE si trovano sia 74,8% sia 74,1%). Per giudicare davvero il modello servono i test indipendenti.
Cosa dice la scheda di sicurezza
OpenAI ha pubblicato un addendum alla system card di GPT-6 Astra. Nel Preparedness Framework il modello è classificato Critical in cybersecurity e High per le capacità biologiche e chimiche, con lo stesso insieme di protezioni di Astra. Sul fronte dell'onestà, nella programmazione il tasso di travisamento dei risultati (quando il modello descrive in modo scorretto ciò che ha fatto) è dell'1,50%, contro lo 0,51% di Astra: un dato da tenere d'occhio per chi affida a Sol compiti lunghi e autonomi.
Dove si usa
- API OpenAI, con l'identificativo
gpt-6.1-sol - ChatGPT Work e Codex, per i piani Plus, Pro, Business, Enterprise ed Edu
- Microsoft Foundry, la piattaforma di Microsoft per i modelli di intelligenza artificiale
Cosa significa per chi sviluppa prodotti e servizi
Il costo è spesso il motivo per cui una funzione basata sull'intelligenza artificiale resta sulla carta. Con prestazioni vicine a quelle del modello di punta a un quinto della spesa, assistenti, automazioni e strumenti interni diventano più sostenibili anche per aziende piccole. Il consiglio pratico è lo stesso di sempre: provare il modello sui propri casi d'uso e confrontare qualità e costo per compito, non solo il prezzo per token.
Leggi anche: Google presenta Gemini 4 Argon e Claude Sonnet 5.5, più veloce e meno costoso.
