Cei care construiesc AI sunt cei mai slabi la a-l prezice

Răspuns rapid

Optsprezece predicții AI datate din 2024 și 2025, notate după propriile cuvinte și propriile termene. Predicțiile despre capacități s-au adeverit în mare parte, unele chiar mai devreme. Predicțiile despre implementare, agenți care se alătură forței de muncă, un miliard de agenți Agentforce, programatori înlocuiți într-un an, au eșuat aproape uniform. Cel mai bun punctaj l-a obținut scepticul Gary Marcus cu A-, iar faptul că a avut dreptate nu i-a adus nimic.

Nimeni nu se mai întoarce să verifice

În martie 2025, Dario Amodei a spus Council on Foreign Relations că AI va scrie 90% din cod în trei până la șase luni și aproape tot codul în douăsprezece luni. Acel termen de douăsprezece luni a expirat în martie. Aproape nimeni nu s-a mai întors să verifice.

Aceasta este eticheta ciudată a prognozelor despre AI. Predicțiile sunt zgomotoase, datate și livrate cu încredere totală, apoi data sosește și toată lumea a trecut deja la următoarea. Nu există un tabel de scor. Așa că am construit unul.

În februarie 2025, am planificat fluxuri de lucru cu agenți în Whizi, pornind de la premisa că Altman avea dreptate despre 2025. Am oprit proiectul șase săptămâni mai târziu, după ce am calculat cât costă o singură rulare de agent cu mai mulți pași față de un abonament lunar fix. Șase săptămâni din propria mea foaie de parcurs, cheltuite pe prognoza altcuiva. Am adunat fiecare predicție datată din 2024 și 2025 pe care am găsit-o cu o sursă primară și un termen care a trecut deja. Optsprezece au trecut de filtru.

Regula de notare, ca să poți contrazice: o predicție este notată după ce au promis propriile cuvinte, la propriul termen. Dacă ai spus 90% până în septembrie și septembrie a adus 30%, "păi, până la urmă" nu e o notă. E o scuză.

Tabelul de scor

Cine, cândPredicțiaCe s-a întâmplatNotă
Sam Altman, ianuarie 2025Agenții AI "se alătură forței de muncă" în 202595% dintre proiectele pilot enterprise nu au arătat impact asupra P&L; cel mai bun agent a finalizat 30,3% din sarcinile de birouC-
Marc Benioff, septembrie 2024Un miliard de agenți Agentforce până la sfârșitul lui 2025Circa 29.000 de contracte și $1B venit recurent anualF
Klarna, februarie 2024Asistentul AI face munca a 700 de agențiReangajează oameni din mai 2025 pentru calitate mai bunăC
Dario Amodei, martie 202590% din cod în trei până la șase luni25% până la 41% la nivel de industrie, 75% la Google până la mijlocul lui 2026C+
Dario Amodei, martie 2025Aproape tot codul în douăsprezece luniNu s-a apropiatF
Eric Schmidt, aprilie 2025Marea majoritate a programatorilor înlocuiți într-un anProgramatorii încă angajați; posturile de nivel entry în scădere cu circa 16%F
Mark Zuckerberg, ianuarie 2025Un inginer AI de nivel mediu, cel mai folosit asistent cu un miliard de utilizatori și Llama drept cel mai bun model, toate în 2025Niciuna dintre cele trei; în schimb, salarii record pentru inginerii umaniF
Elon Musk, aprilie 2024AI mai deștept decât orice om până la sfârșitul lui 2025Grok 4 a obținut 25,4% la Humanity's Last ExamF
Mira Murati, iunie 2024Inteligență de nivel doctorat "pentru sarcini specifice" în circa 18 luniO medalie de aur certificată la Olimpiada Internațională de Matematică din 2025B-
Gary Marcus, ianuarie 202525 de predicții datate, patru notate aiciToate patru corecte, dar niciun succes al anului pe listăA-

Forța de muncă care nu s-a prezentat niciodată la muncă

Sam Altman, ianuarie 2025: "Credem că, în 2025, s-ar putea să vedem primii agenți AI care 'se alătură forței de muncă' și schimbă substanțial producția companiilor."

Proiectul NANDA al MIT a constatat în august 2025 că 95% dintre proiectele pilot enterprise de AI generativ nu au produs niciun impact măsurabil asupra P&L. Carnegie Mellon a angajat o companie fictivă exclusiv cu agenți AI și a măsurat munca de birou finalizată: cel mai bun model a completat 30,3% din sarcini. Un angajat de 30% nu se alătură forței tale de muncă. Iese din perioada de probă.

O excepție salvează situația de la un F: în companiile de software, agenții de programare chiar au schimbat producția. Notă: C-.

Marc Benioff, septembrie 2024: "Viziunea noastră este îndrăzneață: să dăm putere unui miliard de agenți cu Agentforce până la sfârșitul lui 2025."

Salesforce a raportat aproximativ 29.000 de contracte Agentforce cumulate până la începutul lui 2026 și a depășit $1B venit recurent anual. O afacere reală, dar de circa 34.000 de ori sub promisiune, numărând contracte, nu agenți. Detaliul meu preferat: Salesforce raportează acum "unități de muncă agentică prestate" (3,8 miliarde dintre ele) în loc de numărul de agenți. Când nu poți atinge cifra, schimbi unitatea. Notă: F.

Klarna, februarie 2024: asistentul său AI "face munca echivalentă a 700 de agenți cu normă întreagă."

Apoi, în mai 2025, CEO-ul Sebastian Siemiatkowski a schimbat direcția și a început să reangajeze oameni: "Ne-am concentrat prea mult pe eficiență și cost. Rezultatul a fost calitate mai slabă." AI a păstrat tichetele de rutină. Oamenii s-au întors pentru tot ce conta cu adevărat. Merită credit pentru că a rulat experimentul public și a admis rezultatul. Notă: C.

Codul care chiar s-a scris

Cei 90% ai lui Amodei. Direcția a fost corectă, numitorul a fost greșit. Google spune că 75% din codul său nou este generat de AI la mijlocul lui 2026, față de 25% la finalul lui 2024, deși asta include orice autocompletare acceptată, iar oamenii încă revizuiesc înainte de lansare. Estimările la nivel de industrie de la începutul lui 2026 s-au grupat între 25% și 41%.

Deci: 90% din tot codul în șase luni, nu. Aproape tot codul în douăsprezece luni, nici pe departe. O schimbare istorică în felul în care se scrie codul, absolut da. Predicția a descris o revoluție reală și a greșit fiecare cifră. Notă: C+ pentru cei 90%, F pentru "aproape tot".

Eric Schmidt, aprilie 2025: "în următorul an, marea majoritate a programatorilor vor fi înlocuiți de programatori AI."

Anul a trecut. Programatorii rămân angajați aproape peste tot unde erau angajați înainte. Daunele reale asupra pieței muncii sunt mai înguste și mai crude decât predicția: datele Stanford și ADP privind salarizarea arată că angajarea persoanelor de 22 până la 25 de ani în cele mai expuse la AI joburi a scăzut cu circa 16% de la sfârșitul lui 2022 și continuă să scadă. Nivelul entry a primit lovitura; marea majoritate și-a păstrat joburile și a primit licențe de Copilot. Notă: F.

Și cifra pe care nimeni nu a prezis-o: Cursor a trecut de la $100M la $4B venit recurent anual în circa șaptesprezece luni, iar pe 14 august SpaceX a finalizat achiziția companiei pentru $60B, cea mai mare achiziție de startup înregistrată vreodată. Nicio listă de predicții din 2024 pe care am verificat-o nu conținea "un editor de cod devine cea mai mare ieșire de startup din istorie".

Anul foarte scump al lui Meta

Mark Zuckerberg, ianuarie 2025, la Joe Rogan: "Probabil în 2025, la Meta... vom avea un AI care poate fi practic un fel de inginer de nivel mediu pe care îl ai în companie și care poate scrie cod." La apelul cu investitorii câteva săptămâni mai târziu, a mai adăugat două ținte pentru 2025: Meta AI ca cel mai folosit asistent cu un miliard de utilizatori, și Llama ca cel mai avansat și mai folosit model.

Niciuna dintre cele trei nu s-a întâmplat. Llama 4 a apărut fără impact, în timp ce Gemini 3 a luat coroana de frontieră în noiembrie 2025. Iar Meta și-a petrecut anul făcând pariul opus cu portofelul: $14.3B pentru jumătate din Scale AI, salarii de cercetători raportate între $100M și $450M, apoi 600 de persoane concediate din laboratorul de superinteligență în octombrie și circa 8.000 de concedieri în mai 2026.

Meta a prezis un AI care programează ca un inginer de nivel mediu și, în schimb, a petrecut optsprezece luni stabilind recordul mondial de preț de piață pentru inginerii umani. Notă: F.

Elon Musk, aprilie 2024: AI "mai deștept decât orice om, probabil pe la finalul anului viitor."

Până la sfârșitul lui 2025, modelul emblematic al xAI era Grok 4, lansat drept "cel mai deștept AI din lume", cu un scor de 25,4% la un benchmark numit chiar Humanity's Last Exam. Afirmația nu a supraviețuit contactului cu examenul. Notă: F.

Mira Murati, iunie 2024: inteligență de nivel doctorat "pentru sarcini specifice" în circa optsprezece luni.

La matematică, practic s-a întâmplat: Deep Think de la Google DeepMind a obținut o medalie de aur certificată oficial la Olimpiada Internațională de Matematică din 2025, cu ani înaintea majorității prognozelor din 2024. Calificativul folosit de ea, "pentru sarcini specifice", face toată munca grea și este exact calificativul pe care colegii ei mai zgomotoși au refuzat să îl folosească. Versiunea nuanțată s-a adeverit. Cea nenuanțată, lansată drept marca "nivel de doctorat" a GPT-5 în august 2025, a mers destul de prost încât Altman a recunoscut că OpenAI "a dat total-total greș" la lansare. Notă: B-.

Fișa de note a scepticului

Gary Marcus a publicat 25 de predicții datate pe 1 ianuarie 2025. Industria de obicei îl ignoră ironic. Notăm afirmațiile lui evaluabile:

  • "Nu vom vedea inteligență artificială generală anul acesta." Corect.
  • Agenții vor fi "hipați la infinit pe tot parcursul lui 2025, dar departe de a fi fiabili." Corect, vezi întreaga primă secțiune.
  • "Profiturile din modelele AI vor rămâne modeste sau inexistente." Veniturile au explodat, dar el a vorbit despre profituri, iar laboratoarele încă ard bani. Corect la literă.
  • Posibil, niciun consens de tip "nivel GPT-5" în 2025. GPT-5 a apărut; saltul de consens, nu. Corect în spirit.

Notă: A-. Minusul este pentru ce nu conține lista: nimic din ea nu a prezis o categorie de unelte de programare de $4B, o medalie de aur la Olimpiada Internațională de Matematică sau agenți devenind cu adevărat utili tocmai în domeniul unde rezultatul se poate verifica. Cel mai bun prognozator al anului 2025 a ghicit fiecare eșec și a ratat fiecare succes.

Și faptul incomod de ordinul al doilea: a avea dreptate nu i-a adus aproape nimic. Investitorii care au pariat împotriva întregii sale viziuni sunt exact cei care au evaluat Cursor la $60B. Acuratețea prognozei și randamentele financiare rulează pe tabele de scor separate, și doar unul dintre ele se compune.

Predicțiile despre capacități s-au adeverit. Cele despre implementare, nu

Sortează cele 18 predicții în două grămezi și zgomotul dispare.

Predicțiile despre capacități, ce vor putea face modelele, au îmbătrânit bine și uneori s-au adeverit mai devreme. Durata sarcinilor pe care agenții le pot finaliza s-a dublat cam la fiecare patru până la șapte luni, potrivit METR, iar tendința s-a menținut.

Predicțiile despre implementare, ce va lăsa AI să facă cu adevărat organizațiile, au eșuat aproape uniform. Agenți în forța de muncă, platforme cu un miliard de agenți, programatori înlocuiți, angajați AI: toate au lovit același zid de standarde de calitate, răspundere legală, cost de integrare și faptul încăpățânat că un sistem care completează 30% din sarcini e un demo, nu o angajare.

Altman a spus că agenții se vor alătura forței de muncă. S-au alăturat mediului de dezvoltare (IDE), pentru că IDE-ul e singurul loc de muncă unde un răspuns greșit e prins de un compilator, nu de un client.

Iată regula de decizie pe care o folosesc acum, cu banii mei pe masă: când auzi o predicție despre capacități, ia-o în serios, chiar și pe cele extreme, pentru că liniile de tendință tot câștigă. Când auzi o predicție de implementare cu o dată atașată, dublează termenul, apoi verifică ce vinde persoana care o spune. Aceeași regulă e cum aleg ce model să plătesc: benchmark-ul e o afirmație despre capacități, fluxul de lucru e o afirmație despre implementare.

În fiecare trimestru de acum înainte notez tot ce a ajuns la termen, iar ediția următoare se deschide cu propriile mele predicții datate, ca să mă poți evalua după aceeași grilă. Notarea e gratuită. A fi notat costă.

Listă de verificare
  • Notează o predicție după propriile cuvinte, la propriul termen; "până la urmă" nu e o notă
  • Ia în serios predicțiile despre capacități, chiar și pe cele extreme; liniile de tendință tot câștigă
  • Dublează orice termen de implementare care are o dată atașată
  • Verifică ce vinde persoana care face predicția
  • Scrie-ți propriile predicții cu date, ca cineva să te poată nota la rândul lui

Întrebări frecvente

A avut dreptate Dario Amodei că AI va scrie 90% din cod?

Nu la termenul lui. A spus 90% în trei până la șase luni de la martie 2025 și aproape tot codul în douăsprezece luni. Estimările la nivel de industrie de la începutul lui 2026 s-au grupat între 25% și 41%, cu Google la 75% din codul nou până la mijlocul lui 2026, numărând orice autocompletare acceptată. Direcția a fost corectă, cifrele au fost greșite.

S-au alăturat agenții AI forței de muncă în 2025?

Nu în afara software-ului. Proiectul NANDA al MIT a constatat că 95% dintre proiectele pilot enterprise de AI generativ nu au produs niciun impact măsurabil asupra P&L, iar testul companiei de agenți al Carnegie Mellon a arătat că cel mai bun model a finalizat 30,3% din sarcinile de birou. Agenții de programare din companiile de software au fost singura excepție reală.

Cine a prezis cel mai corect anul 2025 în AI?

Gary Marcus, scepticul, pe afirmațiile notate aici: fără AGI, agenți hipați dar nefiabili, profituri încă modeste, fără salt de consens la nivel GPT-5. Toate patru s-au confirmat. Lista lui a ratat și fiecare succes al anului, de la categoria de unelte de programare de $4B la medalia de aur de la Olimpiada de Matematică.