Il prezzo dei modelli crolla dell'80% mentre Gemini supera il miliardo di utenti
GPT-5.6 Luna diventa il modello gratuito predefinito di ChatGPT dopo un taglio di prezzo dell'80%, Google annuncia il miliardo di utenti mensili, DeepSeek va in direzione opposta e alza le tariffe del 93%. Sullo sfondo, un modello non rilasciato che rivendica dieci problemi matematici aperti risolti.
Il mercato dei modelli linguistici, in agosto, si muove su due assi contemporaneamente: il prezzo e la scala d’uso. Sul primo, la decisione più aggressiva risale al 30 luglio, quando il costo di GPT-5.6 Luna è stato tagliato dell’80%, da 1 a 0,20 dollari per milione di unità di testo elaborate. La conseguenza diretta è che quel modello è diventato il predefinito gratuito di ChatGPT: una capacità che fino a poche settimane prima era a pagamento viene messa alla base dell’offerta senza costo.
Sul secondo asse, il numero è di Google: Gemini ha superato il miliardo di utenti attivi mensili l’11 agosto 2026. È la cifra che, in questo settore, misura la distribuzione più che la qualità — e la distribuzione, quando i modelli si equivalgono, è il vantaggio competitivo che pesa di più.
Non tutti però stanno abbassando i listini. Il 14 agosto DeepSeek ha aumentato del 93% il prezzo di V4 Flash, portandolo da 0,14 a 0,27 dollari per milione di unità elaborate. Il nuovo listino si colloca dunque sopra i 0,20 dollari di GPT-5.6 Luna, e la direzione del movimento è opposta a quella del resto del mercato: è il primo caso recente di un fornitore che decide di far pagare di più anziché rincorrere il ribasso.
| Operatore | Mossa | Data |
|---|---|---|
| OpenAI | GPT-5.6 Luna da 1 a 0,20 dollari per milione di unità (−80%) | 30 luglio |
| Gemini oltre il miliardo di utenti mensili | 11 agosto | |
| xAI | Grok 4.6, punteggio 61 sull’Artificial Analysis Intelligence Index | 12 agosto |
| DeepSeek | V4 Flash da 0,14 a 0,27 dollari per milione di unità (+93%) | 14 agosto |
Il lancio di xAI del 12 agosto merita una nota a parte: Grok 4.6 arriva con un punteggio di 61 sull’Artificial Analysis Intelligence Index e allo stesso prezzo del predecessore Grok 4.5. Prestazione superiore a costo invariato è, dal punto di vista dell’acquirente, un taglio di prezzo implicito.
C’è poi la variabile velocità. OpenAI ha annunciato un livello di servizio chiamato Ultrafast, basato su hardware Cerebras, che esegue GPT-5.6 Sol fino a 14 volte più rapidamente e genera fino a 750 unità di testo al secondo. È un dato che sposta la concorrenza dal costo per unità elaborata al tempo di risposta: per le applicazioni interattive, la latenza conta quanto il prezzo.
Sopra questo mercato in movimento c’è un annuncio di natura diversa. Il 1° agosto 2026 OpenAI ha presentato la famiglia di modelli Astra dichiarando che una versione interna ha risolto dieci problemi aperti di matematica e informatica teorica. Le dimostrazioni formali sono state pubblicate in Lean su GitHub — cioè in un linguaggio che consente la verifica automatica dei passaggi logici, il che rende l’affermazione controllabile da terzi anziché autocertificata. Fra i risultati figurano una costruzione che prova l’esistenza di gruppi non sofici e nuovi limiti sull’impacchettamento di sfere.
Il commento più citato è quello del medagliato Fields Timothy Gowers, che ha dichiarato che raccomanderebbe senza esitazioni una di quelle dimostrazioni per una rivista di primo piano. È una valutazione autorevole e va presa sul serio; è anche una valutazione su un singolo risultato, non sull’intero pacchetto.
Due limiti vanno detti con la stessa chiarezza dell’annuncio. Il primo: la versione di Astra utilizzata per quei risultati non è stata rilasciata pubblicamente, quindi nessuno all’esterno può riprodurre l’esperimento nelle stesse condizioni. Il secondo: le analisi di settore osservano che i risultati si concentrano in aree particolarmente adatte ai punti di forza di questi modelli e non equivalgono a un’intelligenza generale.
Il quadro che ne esce è coerente. Sul fronte commerciale il prezzo scende e la distribuzione si concentra; sul fronte della ricerca gli annunci più clamorosi riguardano modelli che non si possono usare. Le due cose non si contraddicono: il prodotto e la vetrina, in questo settore, sono ormai oggetti distinti.
Fonti: AIToolsRecap; Releasebot — note di rilascio OpenAI; Build Fast with AI; Kraviona.
← Archivio · Prima pagina · Editoriali passati · Segnala un errore