Nessuno torna a verificare
Nel marzo 2025 Dario Amodei ha detto al Council on Foreign Relations che l'IA avrebbe scritto il 90% del codice entro tre o sei mesi, e praticamente tutto entro dodici. Quella scadenza di dodici mesi è passata a marzo. Quasi nessuno è tornato a verificare.
È la strana etichetta delle previsioni sull'IA. Le affermazioni sono roboanti, datate, pronunciate con totale sicurezza, poi la data arriva e tutti sono già passati alla previsione successiva. Non esiste un tabellone. Quindi l'ho costruito io.
Nel febbraio 2025 avevo pianificato i flussi ad agenti dentro Whizi partendo dal presupposto che Altman avesse ragione sul 2025. Ho chiuso il progetto sei settimane dopo, dopo aver fatto i conti su quanto costa un singolo run di agente multi-passo rispetto a un abbonamento mensile fisso. Sei settimane della mia roadmap, spese sulla previsione di qualcun altro. Ho raccolto ogni previsione datata del 2024 e del 2025 con una fonte primaria e una scadenza già passata. Diciotto sono entrate nella selezione.
La regola di valutazione, così puoi contestarla: una previsione si valuta rispetto a ciò che le sue stesse parole promettevano, sulla sua stessa scadenza. Se hai detto 90% entro settembre e settembre ha portato il 30%, "beh, prima o poi" non è un voto. È una scusa.
Il tabellone
| Chi, quando | La previsione | Cosa è successo | Voto |
|---|---|---|---|
| Sam Altman, gennaio 2025 | Gli agenti IA "entrano nella forza lavoro" nel 2025 | Il 95% dei progetti pilota aziendali non ha mostrato impatto sul conto economico; il miglior agente ha completato il 30,3% dei compiti d'ufficio | C- |
| Marc Benioff, settembre 2024 | Un miliardo di agenti Agentforce entro fine 2025 | Circa 29.000 contratti e $1B di ricavi ricorrenti annui | F |
| Klarna, febbraio 2024 | Assistente IA che svolge il lavoro di 700 agenti | Riassunzione di persone da maggio 2025 per qualità più bassa | C |
| Dario Amodei, marzo 2025 | 90% del codice entro tre o sei mesi | 25% al 41% a livello di settore, 75% in Google entro metà 2026 | C+ |
| Dario Amodei, marzo 2025 | Praticamente tutto il codice entro dodici mesi | Non ci siamo nemmeno vicini | F |
| Eric Schmidt, aprile 2025 | La grande maggioranza dei programmatori sostituita entro un anno | Programmatori ancora impiegati; ruoli entry level giù di circa il 16% | F |
| Mark Zuckerberg, gennaio 2025 | Un ingegnere IA di livello medio, il principale assistente da un miliardo di utenti, e Llama come modello migliore, tutto entro il 2025 | Nessuna delle tre cose; pacchetti retributivi record per ingegneri umani, invece | F |
| Elon Musk, aprile 2024 | IA più intelligente di qualunque essere umano entro fine 2025 | Grok 4 ha ottenuto il 25,4% su Humanity's Last Exam | F |
| Mira Murati, giugno 2024 | Intelligenza di livello dottorato "per compiti specifici" tra circa 18 mesi | Un oro certificato alle Olimpiadi Internazionali di Matematica 2025 | B- |
| Gary Marcus, gennaio 2025 | 25 previsioni datate, quattro valutate qui | Tutte e quattro corrette, e nessuno dei successi dell'anno nella lista | A- |
La forza lavoro che non ha mai timbrato il cartellino
Sam Altman, gennaio 2025: "Crediamo che, nel 2025, potremmo vedere i primi agenti IA 'entrare nella forza lavoro' e cambiare in modo sostanziale l'output delle aziende."
Il progetto NANDA del MIT ha rilevato nell'agosto 2025 che il 95% dei progetti pilota aziendali di IA generativa non ha prodotto un impatto misurabile sul conto economico. Carnegie Mellon ha messo su un'azienda finta interamente gestita da agenti IA e ha misurato il lavoro d'ufficio completato: il miglior modello ha finito il 30,3% dei compiti. Un dipendente al 30% non entra nella tua forza lavoro. Esce dal periodo di prova.
Un'eccezione salva questo voto da una F: dentro le aziende software, gli agenti di programmazione hanno davvero cambiato l'output. Voto: C-.
Marc Benioff, settembre 2024: "La nostra visione è audace: mettere in campo un miliardo di agenti con Agentforce entro la fine del 2025."
Salesforce ha riportato circa 29.000 contratti Agentforce cumulativi entro l'inizio del 2026 e ha superato $1B di ricavi ricorrenti annui. Un business reale, e circa 34.000 volte sotto la promessa, contando i contratti anziché gli agenti. Il mio dettaglio preferito: Salesforce ora riporta "unità di lavoro agentico erogate" (3,8 miliardi) invece di un conteggio di agenti. Quando non riesci a raggiungere il numero, cambi l'unità di misura. Voto: F.
Klarna, febbraio 2024: il suo assistente IA "svolge l'equivalente del lavoro di 700 agenti a tempo pieno."
Poi, nel maggio 2025, l'amministratore delegato Sebastian Siemiatkowski ha invertito la rotta e ha iniziato a riassumere persone: "Ci siamo concentrati troppo sull'efficienza e sui costi. Il risultato è stata una qualità più bassa." L'IA ha tenuto i ticket di routine. Gli esseri umani sono tornati per tutto ciò che contava. Merito per aver condotto l'esperimento in pubblico e ammesso il risultato. Voto: C.
Il codice che è stato davvero scritto
Il 90% di Amodei. La direzione era giusta e il denominatore era sbagliato. Google dichiara che il 75% del suo nuovo codice è generato dall'IA a metà 2026, in salita dal 25% di fine 2024, anche se questo conteggio include ogni autocompletamento accettato e gli esseri umani rivedono ancora prima del deploy. Le stime a livello di settore a inizio 2026 si concentravano tra il 25% e il 41%.
Quindi: 90% di tutto il codice in sei mesi, no. Praticamente tutto il codice in dodici, per niente vicino. Un cambiamento storico nel modo di scrivere codice, assolutamente sì. La previsione descriveva una rivoluzione reale e ha sbagliato ogni numero. Voto: C+ per il 90%, F per "praticamente tutto".
Eric Schmidt, aprile 2025: "nel prossimo anno, la grande maggioranza dei programmatori sarà sostituita da programmatori IA."
L'anno è scaduto. I programmatori restano impiegati quasi ovunque fossero impiegati prima. Il vero danno occupazionale è più circoscritto e più crudele della previsione: i dati sui salari di Stanford e ADP mostrano che l'occupazione tra i 22 e i 25 anni nei lavori più esposti all'IA è scesa di circa il 16% da fine 2022 ed è ancora in calo. I livelli entry level hanno incassato il colpo; la grande maggioranza ha mantenuto il lavoro e ricevuto licenze Copilot. Voto: F.
E il numero che nessuno aveva previsto: Cursor è passato da $100M a $4B di ricavi ricorrenti annui in circa diciassette mesi, e il 14 agosto SpaceX ha chiuso l'acquisizione da $60B dell'azienda, la più grande acquisizione di startup mai registrata. Nessuna lista di previsioni del 2024 che ho controllato aveva "un editor di codice diventa la più grande uscita di startup della storia" tra le voci.
L'anno molto costoso di Meta
Mark Zuckerberg, gennaio 2025, da Joe Rogan: "Probabilmente nel 2025, noi di Meta... avremo un'IA che può essere effettivamente una specie di ingegnere di livello medio che hai in azienda e che sa scrivere codice." Nella call sugli utili di settimane dopo ne ha aggiunte altre due per il 2025: Meta AI come principale assistente da un miliardo di utenti, e Llama come modello più avanzato e più usato.
Nessuna delle tre si è avverata. Llama 4 è arrivato con un tonfo mentre Gemini 3 ha preso la corona di frontiera nel novembre 2025. E Meta ha passato l'anno a fare la scommessa opposta con il portafoglio: $14.3B per metà di Scale AI, pacchetti retributivi per ricercatori riportati tra $100M e $450M, poi 600 persone tagliate dal laboratorio sulla superintelligenza in ottobre e circa 8.000 licenziamenti a maggio 2026.
Meta aveva previsto un'IA che programma come un ingegnere di livello medio, e invece ha passato diciotto mesi a fissare il record mondiale del prezzo di mercato per quelli umani. Voto: F.
Elon Musk, aprile 2024: un'IA "più intelligente di qualsiasi essere umano, probabilmente entro la fine dell'anno prossimo."
Entro fine 2025, il modello di punta di xAI era Grok 4, lanciato come "l'IA più intelligente del mondo", con un punteggio del 25,4% su un benchmark chiamato letteralmente Humanity's Last Exam. L'affermazione non è sopravvissuta al contatto con l'esame. Voto: F.
Mira Murati, giugno 2024: intelligenza di livello dottorato "per compiti specifici" tra circa diciotto mesi.
Per la matematica è praticamente successo: Deep Think di Google DeepMind ha ottenuto un oro ufficialmente certificato alle Olimpiadi Internazionali di Matematica 2025, anni prima di quanto previsto dalla maggior parte delle stime del 2024. La precisazione che ha usato, "per compiti specifici", pesa parecchio, ed è esattamente la precisazione che i suoi colleghi più rumorosi si sono rifiutati di usare. La versione con riserve si è avverata. Quella senza riserve, spedita come branding "PhD-level" di GPT-5 nell'agosto 2025, è andata male al punto che Altman ha ammesso che OpenAI "ha completamente sbagliato" il lancio. Voto: B-.
La pagella dello scettico
Gary Marcus ha pubblicato 25 previsioni datate il 1° gennaio 2025. Il settore lo guarda perlopiù con sufficienza. Valutando le sue affermazioni verificabili:
- "Non vedremo un'intelligenza artificiale generale quest'anno." Corretta.
- Gli agenti saranno "iper-pubblicizzati per tutto il 2025 ma lontani dall'essere affidabili." Corretta, vedi l'intera prima sezione.
- "I profitti dai modelli IA continueranno a essere modesti o inesistenti." I ricavi sono esplosi, ma lui ha parlato di profitti, e i laboratori bruciano ancora cassa. Corretta alla lettera.
- Possibile assenza di un salto di consenso di livello "GPT-5" nel 2025. GPT-5 è arrivato; il salto no. Corretta nello spirito.
Voto: A-. Il meno è per ciò che la lista non contiene: nulla in essa prevedeva una categoria di strumenti di programmazione da $4B, un oro alle Olimpiadi di Matematica, o agenti che diventano davvero utili nell'unico dominio dove l'output è verificabile. Il miglior previsore del 2025 ha azzeccato ogni fallimento e mancato ogni successo.
E il fatto scomodo di secondo livello: avere ragione non gli ha fruttato praticamente nulla. Gli investitori che hanno scommesso contro tutta la sua visione del mondo sono quelli che hanno valutato Cursor a $60B. L'accuratezza delle previsioni e i rendimenti finanziari corrono su tabelloni separati, e solo uno dei due si accumula nel tempo.
Le previsioni sulle capacità si sono avverate. Quelle sull'adozione no
Dividi le 18 previsioni in due mucchi e il rumore di fondo sparisce.
Le previsioni sulla capacità, cosa i modelli sarebbero stati in grado di fare, hanno retto bene e a volte sono arrivate in anticipo. La durata dei compiti che gli agenti riescono a completare è raddoppiata all'incirca ogni quattro o sette mesi, secondo METR, e il trend ha tenuto.
Le previsioni sull'adozione, cosa le organizzazioni avrebbero davvero lasciato fare all'IA, sono fallite quasi ovunque. Agenti nella forza lavoro, piattaforme da un miliardo di agenti, programmatori sostituiti, dipendenti IA: tutto ha sbattuto contro lo stesso muro di standard di qualità, responsabilità legale, costo di integrazione, e il fatto ostinato che un sistema che completa il 30% dei compiti è una demo, non un'assunzione.
Altman diceva che gli agenti sarebbero entrati nella forza lavoro. Sono entrati nell'IDE, perché l'IDE è l'unico posto di lavoro dove una risposta sbagliata viene intercettata da un compilatore invece che da un cliente.
Ecco quindi la regola pratica che uso ora, con i miei stessi soldi in gioco: quando senti una previsione sulla capacità, prendila sul serio, anche le più audaci, perché le linee di tendenza continuano a vincere. Quando senti una previsione sull'adozione con una data attaccata, raddoppia la scadenza, poi controlla cosa vende chi la pronuncia. La stessa regola è quella con cui scelgo quale modello pagare: il benchmark è un'affermazione sulla capacità, il flusso di lavoro è un'affermazione sull'adozione.
Da qui in poi, ogni trimestre valuto ciò che è scaduto, e la prossima edizione si apre con le mie stesse previsioni datate, così potrai sottopormi allo stesso schema di valutazione. Valutare è gratis. Essere valutati ha un prezzo.
- Valuta una previsione rispetto alle sue stesse parole, sulla sua stessa scadenza; "prima o poi" non è un voto
- Prendi sul serio le previsioni sulle capacità, anche le più audaci; le linee di tendenza continuano a vincere
- Raddoppia qualunque scadenza sull'adozione che porti una data
- Controlla cosa vende chi fa la previsione
- Scrivi le tue previsioni con le date così qualcuno può valutarti a sua volta
Domande frequenti
Dario Amodei aveva ragione sul fatto che l'IA avrebbe scritto il 90% del codice?
Non entro la sua scadenza. Aveva detto 90% entro tre o sei mesi da marzo 2025 e praticamente tutto il codice entro dodici. Le stime a livello di settore a inizio 2026 si concentravano tra il 25% e il 41%, con Google al 75% del nuovo codice entro metà 2026 contando ogni autocompletamento accettato. La direzione era giusta, i numeri erano sbagliati.
Gli agenti IA sono entrati nella forza lavoro nel 2025?
Non fuori dal software. Il progetto NANDA del MIT ha rilevato che il 95% dei progetti pilota aziendali di IA generativa non ha prodotto un impatto misurabile sul conto economico, e il test dell'azienda di agenti di Carnegie Mellon ha visto il miglior modello finire il 30,3% dei compiti d'ufficio. Gli agenti di programmazione dentro le aziende software sono stati l'unica vera eccezione.
Chi ha previsto il 2025 dell'IA con più precisione?
Gary Marcus, lo scettico, sulle affermazioni valutate qui: niente AGI, agenti iper-pubblicizzati ma inaffidabili, profitti ancora modesti, nessun salto di consenso su GPT-5. Tutte e quattro hanno retto. La sua lista ha anche mancato ogni successo dell'anno, dalla categoria di strumenti di programmazione da $4B all'oro alle Olimpiadi di Matematica.