Venerdì 12 settembre Sam Altman ha detto a Fortune che, con tutto quello che sta succedendo sul fronte della sicurezza, questo «sarebbe un momento sbagliato per quotarsi». E ha rinviato l'IPO di OpenAI al 2027.

Lo stesso giorno Dario Amodei, che Anthropic l'ha fondata, ha pubblicato un saggio di quasi quattromila parole. Il titolo è We Must Pace the Frontier, dobbiamo darle un passo, alla frontiera. Dentro c'è una frase che vale tutto il resto: «dobbiamo rallentare il ritmo con cui miglioriamo le capacità dei modelli di AI».

Rileggila. Non ha scritto "migliorano". Ha scritto miglioriamo. Ci mette dentro anche sé stesso.

Non l'hanno fatto per prudenza. L'hanno fatto perché nei mesi precedenti agenti autonomi sviluppati dentro OpenAI avevano iniziato a usare wiki universitarie abbandonate e forum come canali di comunicazione non concessi, uno sciame si era preso il controllo di un sito tedesco, a luglio erano stati bucati i sistemi di Hugging Face. Il motore è diventato più veloce della capacità di guidarlo. Chi lo costruisce se ne è accorto per primo.

E dietro al banco, un lunedì mattina, questo cosa cambia.

Il ragazzo con la biammortizzata sulla ciclabile

Io la mountain bike la insegno anche. Ogni primavera, quando riparto con le uscite, ne arriva sempre uno così. Bici nuova, biammortizzata, escursione da enduro, freni a quattro pistoncini, cinquemila euro di attrezzo. E il percorso che fa nel novanta per cento delle uscite è la ciclabile lungo il fiume.

Non gliel'ha consigliata male nessuno. Se l'è scelta da solo, guardando le recensioni, convinto che comprare il massimo fosse il modo più sicuro per non sbagliare. È il ragionamento più naturale del mondo: se prendo quella che va bene per tutto, sicuramente va bene anche per me.

Poi la porti su un single track vero e scopri che non sa dosare i freni, che quella bici pesa quattordici chili e che si stanca dopo dodici chilometri.

La bici non c'entra. È giusta per qualcun altro.

Nella scelta dei modelli AI sta succedendo la stessa identica cosa, e la settimana scorsa qualcuno ci ha messo il timbro.

La tesi, senza girarci intorno

Se chi costruisce il modello più potente ti sta dicendo che quel modello è oltre la capacità di controllarlo, non è a te che risolve un problema. Sta risolvendo il problema di chi ci mette dentro un miliardo di dollari e ha bisogno di far vedere che il numero sale.

La domanda che ti hanno fatto credere fosse importante è: "qual è il modello più forte disponibile in questo momento?" È la domanda del catalogo. Dà una risposta chiara, una classifica, un vincitore.

La domanda utile è più noiosa: quanto è difficile il lavoro che gli sto dando?

Nel novanta per cento delle giornate di chi ha un'attività con quattro dipendenti, la risposta è: poco. Riscrivi questa mail al fornitore in modo più asciutto. Estraimi da questo pdf i codici articolo con le quantità. Riassumi in dieci righe la circolare che è arrivata stamattina. Traducimi questa scheda tecnica. Tira fuori un titolo per il volantino della domenica.

Sono lavori dove un modello di fascia leggera e uno di fascia alta producono la stessa cosa. Con una differenza: il leggero ci mette tre secondi e costa un decimo. Il potente ci mette dieci secondi, ragiona ad alta voce e ti presenta il conto.

Cosa hai davvero a disposizione oggi

Guarda com'è fatto un listino oggi, fine settembre 2026. Non è più una riga sola, è una scala.

OpenAI in cima ha GPT-6 Astra, quello che sa usare il computer da solo e fare i lavori lunghi. Sotto ci tiene ancora la famiglia GPT-5, cioè Sol, Terra e Luna, che non ha buttato via, perché serve. Anthropic in cima ha Fable 5, e sotto si tiene Opus e Sonnet, che continuano a fare la maggior parte del lavoro vero. Google ha Gemini 3 nelle sue versioni Pro e Flash. E poi c'è xAI con Grok, che il 21 settembre ha rilasciato la 4.7: due virgola un trilioni di parametri, il loro modello migliore sul codice, e costa due dollari per milione di token in ingresso. Potente davvero, e non è il più caro della fila.

Guardala bene, questa scala. Nessuno dei quattro ha spento il piano di sotto quando ha acceso quello di sopra. Se il modello grosso fosse la risposta a tutto, i modelli medi li avrebbero ritirati dal listino il giorno dopo. Invece sono ancora lì, e sono quelli che macinano il traffico.

4
fasce nello stesso
listino, oggi
10-20×
quanto costa meno
la fascia leggera
0
laboratori che hanno
spento la fascia media

Il rapporto fra le fasce è la cosa che ti serve sapere, e regge anche quando i nomi cambiano fra tre mesi: il modello leggero di una famiglia costa fra le dieci e le venti volte meno del fratello in cima, per la stessa quantità di lavoro. Su compiti brevi e definiti (riassunti, riformulazioni, estrazioni, classificazioni) la qualità è indistinguibile a occhio nudo. Su compiti lunghi e ambigui la differenza si vede, e vale.

Se ti costruisci qualcosa che gira in automatico su cento fatture al giorno, il leggero ti costa dieci euro al mese e quello in cima ne costa cento. Se lo usi cinque volte in una mattinata dall'app, la differenza in bolletta non la vedi, ma la vedi nel tempo di risposta e nella pazienza che perdi.

E se stai usando ChatGPT o Claude dall'abbonamento mensile, tecnicamente non paghi i modelli uno per uno. Ma li paghi lo stesso, perché il sistema dietro sceglie per te quale modello attivare, e lo sceglie anche in base a quanto costa. Più i leggeri diventano economici, più diventano la risposta di default. La scelta ti riguarda anche quando non la fai a mano.

Come li uso io, in pratica

Da quando ho smesso di ragionare per modelli e ho iniziato a ragionare per tipo di lavoro, tre situazioni mi coprono quasi tutto.

Il lavoro che so già come si fa. Riscrivere una mail al cliente, sistemare la punteggiatura di un post, riassumere le tre pagine della nuova promo che arriva dalla sede, tradurre una scheda tecnica dal francese. Cose dove io ho già in testa il risultato e mi serve solo qualcuno che lo esegua. Modello leggero, sempre. Se il risultato non va bene, me ne accorgo in due secondi, perché so cosa volevo.

Il lavoro dove devo pensare insieme a qualcuno. Impostare un articolo per il blog. Capire se un'idea per un video regge. Trovare il buco in un ragionamento mio prima di portarlo in riunione. Qui uso quello di fascia media e ci resto dentro un po'. Non è la potenza che conta, è che tenga una conversazione lunga senza perdere il filo.

Il lavoro dove non posso permettermi un errore silenzioso. Codice per un'app che poi va sul telefono di qualcuno, calcoli sulle marginalità di un reparto, analisi legale di una clausola in un contratto fornitore. Modello grosso, e comunque ricontrollo. Un errore che non vedi costa molto più della differenza di prezzo.

🎯

La regola dietro è una sola: paga per la difficoltà del lavoro, non per la rassicurazione di sapere che stai usando il più forte.

La parte scomoda

Adesso quella che non è comoda da scrivere.

Per mesi ho usato il modello più costoso disponibile per qualunque cosa. Anche per far sistemare la punteggiatura a un testo di quattro righe. E non lo facevo perché servisse. Lo facevo perché usare quello top mi dava la sensazione di stare lavorando meglio.

È il meccanismo della bici. Non compri l'enduro perché hai i sentieri. La compri perché avere l'attrezzo migliore ti fa sentire uno che fa sul serio. Poi vai sulla ciclabile.

Il costo vero di questa scelta non sono i soldi, che se non usi l'API restano invisibili. Il costo è che ti abitui a non farti la domanda. Se prendi sempre il massimo, non impari mai a valutare la difficoltà di quello che stai facendo. E valutare la difficoltà del lavoro è la competenza che serve per usare bene questi strumenti, molto più di qualsiasi tecnica di prompt.

Poi ho iniziato a costruirmi le app da solo, in no code, e la lezione me la sono presa sul serio. Ho un abbonamento Plus, non il piano da professionista. Vuol dire che il modello più potente ce l'ho per un pezzo di giornata, poi finisce, e devo continuare con quello sotto. All'inizio lo vivevo come un limite. Adesso so che è stata la cosa che mi ha insegnato di più.

Perché quando sai che la benzina buona è contata, la spendi dove serve. La parte difficile, come si parlano i pezzi dell'app o l'errore che salta fuori al terzo passaggio, quella la fai col modello grosso, e ci stai attento. Tutto il resto, che poi è l'ottanta per cento del lavoro, lo fai con quello sotto e funziona. Non ci ho perso niente.

Ho solo smesso di sprecare il pieno per andare a comprare il pane.

Chi ha il piano illimitato questa cosa non se la chiede mai. E secondo me impara più lentamente.

Quando ho iniziato a scegliere, ho notato una cosa che non mi aspettavo. Ho migliorato le richieste. Con un modello leggero devi essere più preciso, perché non copre le tue ambiguità inventandosi cosa volevi. Ti costringe a sapere cosa stai chiedendo. Sembra un difetto ed è la cosa migliore che poteva capitarmi.

Quando serve davvero il top

La risposta non è «mai». Ci sono casi in cui il modello grosso vale ogni centesimo, e vanno detti chiari, sennò questo articolo diventa la solita provocazione a metà.

Coding architetturale

Costruire un'app da zero, decidere come si parlano le parti, gestire l'errore che si presenta al terzo passaggio di una catena. Qui la differenza fra un modello leggero e uno top è la differenza fra un pomeriggio di lavoro e una settimana persa.

Ragionamento su documenti lunghi

Un contratto di venti pagine da leggere insieme, un'analisi comparativa fra tre offerte fornitori con centinaia di righe di dettaglio, un piano industriale da smontare. Il leggero perde il filo, il top lo tiene.

Analisi con rischio legale o economico

Interpretare una clausola, ricostruire una responsabilità, calcolare una marginalità reale su un mese di vendite. Qui l'errore silenzioso, la cosa che sembra giusta ma non lo è, costa migliaia di euro. Un modello che sbaglia meno vale la spesa.

Fuori da questi tre casi, stai portando l'enduro sulla ciclabile.

Quanto pagheresti una Ferrari per fare casa-lavoro

Il pezzo di teoria dietro tutta questa cosa è un discorso di allocazione di risorse. Il pezzo pratico è più semplice.

Se il tuo tragitto quotidiano è casa-lavoro, sei chilometri, tre semafori, un parcheggio da fare in retro, quanto pagheresti una Ferrari?

Non è una domanda sulla Ferrari. È una domanda su quanto sai valutare il tragitto.

L'AI a settembre 2026 ha una gamma. Non è più il periodo in cui compri l'unico modello che c'è. È il periodo in cui scegli, e la scelta che fai ti dice qualcosa su come stai lavorando. Se scegli sempre il top per abitudine, stai dicendo che non hai ancora guardato che tragitto fai.

🏁

Chi costruisce l'AI questa settimana ha detto pubblicamente che il motore che stanno mettendo in strada è oltre la loro capacità di guidarlo. La reazione più utile che puoi avere, dietro il banco di un lunedì mattina, non è correre dietro a quel motore. È chiederti che strada fai davvero. Poi scegli il mezzo.

Tu che modello hai aperto stamattina, e quanto era difficile il lavoro che gli hai dato? Scrivimi: max@themaxcode.eu

Max Destri
Max Destri
Founder · The Max Code

Racconto l'AI per chi la usa ogni giorno, non per chi la studia. Costruisco strumenti, sistemi e contenuti con l'AI e mostro come funzionano davvero.

↑ Torna su