Daniel Reyes, YuSMP Group
Daniel Reyes Principal Engineer, AI/ML, YuSMP Group · sistemi agentici e di retrieval in produzione per team negli Stati Uniti e in Europa
Fila di rack server scuri con moduli compatti illuminati da una luce calda in primo piano, immagine di un modello più piccolo ed economico con prestazioni vicine al top di gamma

In breve

GPT-6.1 Sol ridisegna il rapporto prezzo-prestazioni: OpenAI dichiara risultati quasi da Astra su coding, computer use e lavoro d’ufficio a 2 dollari in input e 10 in output per milione di token, un quinto delle tariffe standard di GPT-6 Astra. Per chi sviluppa sulle API di OpenAI il nuovo ID è gpt-6.1-sol, e il modello è già attivo in ChatGPT Work e Codex per i piani business a pagamento.

La lezione per i team di sviluppo non è «cambiamo tutto». È che molti agenti oggi su Astra per ragioni di qualità possono probabilmente scendere di un livello, e l’unico modo per sapere quali è farli girare in parallelo sulle vostre attività confrontando il costo per attività completata.

Che cosa ha rilasciato OpenAI con GPT-6.1 Sol?

GPT-6.1 Sol è un modello di fascia media che OpenAI posiziona direttamente contro il proprio modello di punta. L’azienda lo descrive come un importante aggiornamento di GPT-6 Sol, con i miglioramenti maggiori nel coding agentico, nel computer use e nel lavoro professionale in più passaggi: debugging, comprensione di documenti ed esecuzione di workflow. CNBC ha notato che il rilascio è arrivato una sola settimana dopo GPT-6 Sol e che la CFO Sarah Friar ha usato il palco per sottolineare il taglio dei prezzi.

Il prezzo è la vera notizia. Le tariffe standard delle API sono 2 dollari per milione di token in input, 0,10 dollari per milione di token in cache e 10 dollari per milione di token in output. VentureBeat, che ha confrontato i listini, indica per GPT-6 Astra 10 e 50 dollari sulle stesse voci: input non in cache e output costano quindi esattamente un quinto, e l’input in cache la metà dei precedenti 0,20 dollari di GPT-6 Sol.

Il lancio porta anche novità di piattaforma importanti per chi costruisce agenti. Secondo OpenAI, Codex può ora girare in locale, da remoto dallo smartphone o nel cloud, e TechCrunch segnala ambienti cloud riutilizzabili che seguono lo sviluppatore su più dispositivi. L’Agents API ha ottenuto il computer use e porta nelle applicazioni personalizzate l’orchestrazione multi-agente in stile Codex, la ricerca degli strumenti e la compattazione del contesto.

Quanto è davvero vicino Sol ad Astra?

Secondo le valutazioni di OpenAI, molto. VentureBeat riporta che GPT-6.1 Sol supera di 6,4 punti percentuali il miglior risultato di GPT-6 Sol su DeepSWE v1.1, guadagna 4,8 punti su AutomationBench e arriva a 2,1 punti da Astra su OSWorld 2.0. TechCrunch aggiunge che il tasso di errori fattuali sui prompt difficili scende dall’11,4% al 7,7% con ragionamento basso e resta entro 1,9 punti da Astra a tutti i livelli di ragionamento.

Sono numeri del fornitore, e il divario residuo tende a emergere proprio dove i team lo avvertono: attività lunghe e ambigue, con molte chiamate agli strumenti e poca supervisione. TechCrunch riferisce inoltre, citando il Wall Street Journal, che un aggiornamento GPT-6.1 Astra è stato accantonato per motivi di sicurezza. Astra quindi per ora resta fermo, e i miglioramenti a breve termine di OpenAI arriveranno su Sol.

La velocità è una scelta a parte. OpenAI annuncia GPT-6.1 Sol Ultrafast nei prossimi giorni, con generazione fino a 8 volte più rapida in Codex e 6 volte nelle API. VentureBeat parla di fino a 300 token al secondo a sei volte il prezzo standard. Utile per il pair programming interattivo e gli assistenti live, uno spreco per agenti in background che nessuno sta guardando.

Che cosa significa per le aziende italiane?

Primo: il routing tra modelli diventa la principale leva sui costi. Una differenza di prezzo di cinque volte tra due modelli separati da pochi punti è troppo grande per ignorarla. Lo schema pratico è un router: attività di coding, smistamento, estrazione e documentali ben delimitate vanno a Sol, mentre Astra resta per i compiti lunghi in cui le vostre valutazioni mostrano ancora un chiaro vantaggio di qualità.

Secondo: misurate il costo per attività, non per token. Un modello più economico che richiede più retry, output più lunghi o chiamate agli strumenti aggiuntive può annullare lo sconto. Tracciate token, chiamate agli strumenti, latenza e tasso di successo per attività completata, per workflow e per livello di ragionamento. È anche così che capirete se Ultrafast si ripaga in uno specifico flusso rivolto agli utenti.

Terzo: il ritmo dei rilasci diventa una questione di governance. Due versioni di Sol in una settimana significano che il comportamento del modello può cambiare più velocemente di quanto preveda la maggior parte dei processi di change management. Gli obblighi di documentazione dell’AI Act europeo, il principio di accountability del GDPR e le consuete verifiche sui fornitori richiedono di sapere quale modello ha prodotto un output. In produzione fissate ID di modello espliciti, registrate il modello indicato in ogni risposta e versionate i risultati delle valutazioni insieme al codice.

Cosa fare prima di passare a Sol?

  1. Rieseguite il set di valutazione. Confrontate GPT-6 Sol, GPT-6.1 Sol e GPT-6 Astra sulle vostre attività, compresi formato e lunghezza dell’output, prima di spostare traffico.
  2. Misurate il costo per attività completata. Registrate token, quota in cache, chiamate agli strumenti, retry e latenza: è lì che il prezzo ridotto a un quinto si conferma o svanisce.
  3. Instradate per workflow. Spostate su Sol prima i workflow che superano i test e tenete Astra come percorso dedicato per gli altri.
  4. Riservate Ultrafast alla latenza. Usatelo solo nei flussi interattivi in cui la velocità cambia il risultato per l’utente; batch e agenti in background restano su standard.
  5. Tenete un rollback e mappate i dati. Fissate l’ID del modello precedente come percorso di riserva finché le vostre metriche non confermano il miglioramento, e documentate quali dati vanno a quale fornitore nel registro dei trattamenti.

Domande frequenti

Che cosa ha rilasciato OpenAI il 29 settembre 2026?

Al DevDay 2026 OpenAI ha rilasciato GPT-6.1 Sol, un aggiornamento di GPT-6 Sol uscito appena una settimana prima. Secondo OpenAI si avvicina al modello di punta GPT-6 Astra su coding agentico, computer use e lavoro professionale. È disponibile in ChatGPT Work e Codex per i piani Plus, Pro, Business, Enterprise ed Edu e nelle API con l’ID gpt-6.1-sol.

Quanto costa GPT-6.1 Sol nelle API?

Il prezzo standard è di 2 dollari per milione di token in input, 0,10 dollari per milione di token in cache e 10 dollari per milione di token in output: un quinto delle tariffe standard di GPT-6 Astra (10 e 50 dollari). Secondo VentureBeat l’input in cache costa la metà rispetto a GPT-6 Sol (0,20 dollari). OpenAI annuncia nei prossimi giorni un livello Ultrafast, molto più veloce e a prezzo maggiorato.

GPT-6.1 Sol può sostituire GPT-6 Astra per gli agenti di coding?

Per molti carichi di lavoro probabilmente sì. Secondo i dati di OpenAI riportati da VentureBeat, GPT-6.1 Sol è a 2,1 punti da Astra su OSWorld 2.0, e secondo TechCrunch il tasso di errori fattuali resta entro 1,9 punti da Astra a tutti i livelli di ragionamento. Sono risultati del fornitore: confrontate i due modelli sulle vostre attività prima di spostare il traffico di produzione.

Che cos’è GPT-6.1 Sol Ultrafast?

Ultrafast è un livello di servizio più veloce che OpenAI annuncia per i prossimi giorni, con generazione dei token fino a 8 volte più rapida in Codex e 6 volte nelle API. VentureBeat parla di fino a 300 token al secondo a sei volte il prezzo standard: adatto al lavoro interattivo sensibile alla latenza, non ai batch o agli agenti in background.

Cosa devono verificare le aziende italiane prima di passare a GPT-6.1 Sol?

Trattare il passaggio come un cambio di modello e non come la sostituzione di una stringa: rieseguire il set di valutazione contro GPT-6 Sol e Astra, misurare costo e latenza per attività completata, instradare solo i workflow che superano i test e tenere il modello precedente come rollback. I dati personali nei prompt restano soggetti al GDPR e alla vigilanza del Garante privacy, che già nel 2024 ha sanzionato OpenAI: conviene documentare quali dati vanno a quale fornitore prima del rilascio.

Fonti

OpenAI — Introducing GPT-6.1 Sol (annuncio ufficiale)
OpenAI — DevDay 2026 recap
TechCrunch — OpenAI launches GPT-6.1 Sol, says it nearly matches GPT-6 Astra and costs less
CNBC — OpenAI DevDay 2026: live updates and announcements
VentureBeat — GPT-6.1 Sol offers Astra-like performance at 1/5th price; Ultrafast tier clocks 300 tokens per second