De som bygger AI er dårligst til å spå den

Kort svar

Atten daterte AI-prediksjoner fra 2024 og 2025, vurdert mot sine egne ord og egne frister. Kapasitetsspådommene slo stort sett til, noen tidligere enn ventet. Utrullingsspådommene, agenter som blir en del av arbeidsstyrken, en milliard Agentforce-agenter, programmerere erstattet innen ett år, feilet nesten uten unntak. Toppscoreren var skeptikeren Gary Marcus med A-, og å ha rett ga ham ingenting.

Ingen går tilbake og sjekker

I mars 2025 fortalte Dario Amodei til Council on Foreign Relations at AI ville skrive 90 prosent av all kode innen tre til seks måneder, og nesten all kode innen tolv. Den tolv måneders fristen gikk ut i mars. Nesten ingen gikk tilbake for å sjekke.

Det er den merkelige uskrevne regelen for AI-spådommer. Prediksjonene er høylytte, daterte og leveres med total selvtillit, og så kommer datoen og alle har gått videre til den neste. Det finnes ingen resultattavle. Så jeg lagde en.

I februar 2025 planla jeg inn agent-arbeidsflyter i Whizi, ut fra antakelsen om at Altman hadde rett om 2025. Jeg skrinla prosjektet seks uker senere, etter å ha regnet på hva en enkelt flerstegs agent-kjøring koster mot et flatt månedsabonnement. Seks uker av min egen kjøreplan, brukt på noen andres spådom. Jeg gravde frem hver daterte 2024- og 2025-prediksjon jeg kunne finne med en primærkilde og en frist som allerede er passert. Atten kom med.

Vurderingsregelen, slik at du kan krangle med den: en spådom vurderes mot det dens egne ord lovet, på dens egen frist. Hvis du sa 90 prosent innen september og september ga 30 prosent, er "vel, etter hvert" ikke en karakter. Det er en unnskyldning.

Resultattavlen

Hvem, nårSpådommenHva som skjeddeKarakter
Sam Altman, januar 2025AI-agenter "blir en del av arbeidsstyrken" i 202595 prosent av pilotprosjekter i bedrifter viste ingen påvirkning på resultatet; den beste agenten fullførte 30,3 prosent av kontoroppgaveneC-
Marc Benioff, september 2024En milliard Agentforce-agenter innen utgangen av 2025Rundt 29 000 avtaler og $1B i årlig tilbakevendende inntektF
Klarna, februar 2024AI-assistent som gjør jobben til 700 ansatteAnsatte folk tilbake fra mai 2025 grunnet lavere kvalitetC
Dario Amodei, mars 202590 prosent av koden innen tre til seks måneder25 til 41 prosent på tvers av bransjen, 75 prosent hos Google midt i 2026C+
Dario Amodei, mars 2025Nesten all kode innen tolv månederLangt unnaF
Eric Schmidt, april 2025Det store flertallet av programmerere erstattet innen ett årProgrammerere er fortsatt ansatt; nybegynnerstillinger ned rundt 16 prosentF
Mark Zuckerberg, januar 2025En AI-ingeniør på mellomnivå, den ledende milliardbruker-assistenten, og Llama som den beste modellen, alt i 2025Ingen av de tre; rekordhøye lønnspakker for menneskelige ingeniører i stedetF
Elon Musk, april 2024AI smartere enn ethvert menneske innen utgangen av 2025Grok 4 fikk 25,4 prosent på Humanity's Last ExamF
Mira Murati, juni 2024Doktorgradsnivå intelligens "for spesifikke oppgaver" innen omtrent 18 månederEn sertifisert gullmedalje ved International Math Olympiad i 2025B-
Gary Marcus, januar 202525 daterte spådommer, fire vurdert herAlle fire riktige, og ingen av årets suksesser er med på listenA-

Arbeidsstyrken som aldri stemplet inn

Sam Altman, januar 2025: "Vi tror at vi i 2025 kan se de første AI-agentene 'bli en del av arbeidsstyrken' og materielt endre selskapenes output."

MITs NANDA-prosjekt fant i august 2025 at 95 prosent av generative AI-pilotprosjekter i bedrifter ikke ga noen målbar effekt på resultatet. Carnegie Mellon bemannet et fiktivt selskap utelukkende med AI-agenter og målte kontorarbeidet de fullførte: den beste modellen fullførte 30,3 prosent av oppgavene. En ansatt med 30 prosent gjennomføring blir ikke med i arbeidsstyrken din. De blir sagt opp i prøvetiden.

Ett unntak redder dette fra en F: inne i programvareselskaper endret kodende agenter faktisk output. Karakter: C-.

Marc Benioff, september 2024: "Vår visjon er dristig: å gi kraft til en milliard agenter med Agentforce innen utgangen av 2025."

Salesforce rapporterte om lag 29 000 kumulative Agentforce-avtaler tidlig i 2026 og passerte $1B i årlig tilbakevendende inntekt. En reell virksomhet, og omtrent 34 000 ganger unna løftet, målt i avtaler fremfor agenter. Min favorittdetalj: Salesforce rapporterer nå "agentiske arbeidsenheter levert" (3,8 milliarder av dem) i stedet for et antall agenter. Når du ikke klarer å nå tallet, bytter du enhet. Karakter: F.

Klarna, februar 2024: AI-assistenten deres "gjør tilsvarende jobb som 700 heltidsansatte."

Så i mai 2025 snudde konsernsjef Sebastian Siemiatkowski og begynte å ansette folk igjen: "Vi fokuserte for mye på effektivitet og kostnad. Resultatet var lavere kvalitet." AI-en beholdt de rutinemessige henvendelsene. Menneskene kom tilbake for alt som betydde noe. Ros for å kjøre eksperimentet offentlig og innrømme resultatet. Karakter: C.

Koden som faktisk ble skrevet

Amodeis 90 prosent. Retningen var riktig og nevneren feil. Google sier at 75 prosent av deres nye kode er AI-generert per midten av 2026, opp fra 25 prosent sent i 2024, selv om det teller hver eneste godkjente autofullføring og mennesker fortsatt gjennomgår koden før den rulles ut. Bransjeanslag tidlig i 2026 klynget seg rundt 25 til 41 prosent.

Så: 90 prosent av all kode på seks måneder, nei. Nesten all kode på tolv, langt unna. Et historisk skifte i hvordan kode skrives, helt klart ja. Spådommen beskrev en reell revolusjon og bommet på hvert eneste tall. Karakter: C+ for de 90 prosentene, F for "nesten alt".

Eric Schmidt, april 2025: "i løpet av det neste året vil det store flertallet av programmerere bli erstattet av AI-programmerere."

Året er omme. Programmerere er fortsatt ansatt nesten overalt der de var ansatt før. Den reelle skaden på arbeidsmarkedet er smalere og grusommere enn spådommen: Stanford- og ADP-lønnsdata viser at sysselsettingen for 22 til 25-åringer i de mest AI-utsatte jobbene har falt med rundt 16 prosent siden sent 2022, og fortsetter å krympe. Nybegynnernivået tok støyten; det store flertallet beholdt jobben og fikk Copilot-lisenser. Karakter: F.

Og tallet ingen spådde i det hele tatt: Cursor gikk fra $100M til $4B i årlig tilbakevendende inntekt på omtrent sytten måneder, og 14. august fullførte SpaceX oppkjøpet av selskapet for $60B, det største oppstartsoppkjøpet noensinne registrert. Ikke en eneste 2024-spådomsliste jeg sjekket hadde "en kodeeditor blir det største oppstartssalget i historien" på listen.

Metas svært kostbare år

Mark Zuckerberg, januar 2025, hos Joe Rogan: "Sannsynligvis i 2025 kommer vi i Meta... til å ha en AI som effektivt kan være en slags ingeniør på mellomnivå som du har i selskapet ditt, som kan skrive kode." På resultatpresentasjonen noen uker senere la han til to til for 2025: Meta AI som den ledende milliardbruker-assistenten, og Llama som den mest avanserte og mest brukte modellen.

Ingen av de tre skjedde. Llama 4 landet med et brak mens Gemini 3 tok førersetet i november 2025. Og Meta brukte året på å gjøre det motsatte veddemålet med lommeboken: $14.3B for halvparten av Scale AI, forskerlønnspakker rapportert mellom $100M og $450M, deretter 600 personer kuttet fra superintelligens-laben i oktober og rundt 8000 oppsigelser i mai 2026.

Meta spådde en AI som koder som en ingeniør på mellomnivå, og brukte i stedet atten måneder på å sette verdensrekord i markedspris for menneskelige ingeniører. Karakter: F.

Elon Musk, april 2024: AI "smartere enn ethvert enkelt menneske, sannsynligvis rundt slutten av neste år."

Ved utgangen av 2025 var xAIs flaggskipmodell Grok 4, lansert som "den smarteste AI-en i verden", som scoret 25,4 prosent på en benchmark bokstavelig talt kalt Humanity's Last Exam. Påstanden overlevde ikke møtet med eksamenen. Karakter: F.

Mira Murati, juni 2024: doktorgradsnivå intelligens "for spesifikke oppgaver" innen omtrent atten måneder.

For matematikk skjedde det i praksis: Google DeepMinds Deep Think tok en offisielt sertifisert gullmedalje ved International Math Olympiad i 2025, år før de fleste 2024-spådommer. Forbeholdet hun brukte, "for spesifikke oppgaver", gjør en stor jobb, og det er nettopp forbeholdet hennes høylytte kolleger nektet å bruke. Den forsiktige versjonen slo til. Den ubetingede versjonen, lansert som GPT-5s "doktorgradsnivå"-merkevare i august 2025, gikk så dårlig at Altman innrømmet at OpenAI "totalt rotet det til" med lanseringen. Karakter: B-.

Skeptikerens karakterkort

Gary Marcus publiserte 25 daterte spådommer 1. januar 2025. Bransjen rister stort sett på hodet av ham. Vurdering av de spådommene som lar seg vurdere:

  • "Vi vil ikke se generell kunstig intelligens i år." Riktig.
  • Agenter vil bli "hypet i det uendelige gjennom hele 2025, men langt fra pålitelige." Riktig, se hele den første delen.
  • "Fortjenesten fra AI-modeller vil fortsette å være beskjeden eller ikke-eksisterende." Omsetningen eksploderte, men han sa fortjeneste, og laboratoriene brenner fortsatt penger. Riktig etter ordlyden.
  • Mulig ingen "GPT-5-nivå" konsensushopp i 2025. GPT-5 ble lansert; hoppet uteble. Riktig i ånden.

Karakter: A-. Minustegnet trekkes for det som ikke er på listen: ingenting i den spådde en $4B-kategori for kodeverktøy, en gullmedalje i IMO, eller at agenter faktisk ble nyttige på det ene området hvor output kan sjekkes. Årets beste spåmann traff hver eneste feilslag og bommet på hver eneste suksess.

Og det ubehagelige faktumet i andre rekke: å ha rett ga ham omtrent ingenting. Investorene som veddet mot hele hans verdenssyn er de som prissatte Cursor til $60B. Prognosepresisjon og finansiell avkastning går på hver sin resultattavle, og bare den ene av dem vokser.

Kapasitetsspådommer slo til. Utrullingsspådommer gjorde ikke det

Sorter de 18 spådommene i to bunker, og støyen forsvinner.

Spådommer om kapasitet, hva modellene ville klare, holdt stikk og kom noen ganger tidligere enn ventet. Lengden på oppgaver agenter kan fullføre har doblet seg omtrent hver fjerde til syvende måned, ifølge METR, og trenden holdt.

Spådommer om utrulling, hva organisasjoner faktisk ville la AI gjøre, feilet nesten uten unntak. Arbeidsstyrke-agenter, milliardagent-plattformer, erstattede programmerere, AI-ansatte: alt sammen traff den samme veggen av kvalitetskrav, ansvar, integrasjonskostnad og det stahaltige faktumet at et system som fullfører 30 prosent av oppgavene er en demo, ikke en nyansettelse.

Altman sa agenter ville bli en del av arbeidsstyrken. De ble en del av IDE-en, fordi IDE-en er det ene arbeidsstedet der et feil svar fanges opp av en kompilator i stedet for en kunde.

Så her er beslutningsregelen jeg bruker nå, med mine egne penger på spill: når du hører en kapasitetsspådom, ta den på alvor, selv de villeste, fordi trendlinjene fortsetter å vinne. Når du hører en utrullingsspådom med en dato festet til seg, doble tidslinjen, og sjekk deretter hva personen som sier det, faktisk selger. Samme regel er hvordan jeg velger hvilken modell jeg skal betale for: benchmarken er en kapasitetspåstand, arbeidsflyten er en utrullingspåstand.

Hvert kvartal fra nå av vurderer jeg det som forfaller, og neste utgave åpner med mine egne daterte spådommer, slik at du kan kjøre meg gjennom samme vurdering. Å gi karakter er gratis. Å få karakter er prisen.

Sjekkliste
  • Vurder en spådom mot dens egne ord, på dens egen frist; "etter hvert" er ikke en karakter
  • Ta kapasitetsspådommer på alvor, selv de villeste; trendlinjene fortsetter å vinne
  • Doble enhver utrullingsfrist med en dato festet til seg
  • Sjekk hva personen som fremsetter spådommen faktisk selger
  • Skriv ned dine egne spådommer med datoer, slik at noen kan gi deg karakter tilbake

Vanlige spørsmål

Hadde Dario Amodei rett i at AI ville skrive 90 prosent av koden?

Ikke innen fristen hans. Han sa 90 prosent innen tre til seks måneder fra mars 2025 og nesten all kode innen tolv. Bransjeanslag tidlig i 2026 klynget seg rundt 25 til 41 prosent, med Google på 75 prosent av ny kode innen midten av 2026, medregnet hver eneste godkjente autofullføring. Retningen var riktig, tallene var feil.

Ble AI-agenter en del av arbeidsstyrken i 2025?

Ikke utenfor programvarebransjen. MITs NANDA-prosjekt fant at 95 prosent av generative AI-pilotprosjekter i bedrifter ikke ga noen målbar effekt på resultatet, og Carnegie Mellons agentselskap-test viste at den beste modellen fullførte 30,3 prosent av kontoroppgavene. Kodende agenter inne i programvareselskaper var det ene reelle unntaket.

Hvem spådde 2025 innen AI mest presist?

Gary Marcus, skeptikeren, på de påstandene som vurderes her: ingen AGI, agenter hypet men upålitelige, fortjeneste fortsatt beskjeden, ingen konsensus-GPT-5-hopp. Alle fire holdt. Listen hans bommet også på hver eneste suksess i løpet av året, fra $4B-kategorien for kodeverktøy til gullmedaljen i IMO.