Ingen går tilbage og tjekker
I marts 2025 fortalte Dario Amodei til Council on Foreign Relations, at AI ville skrive 90% af koden inden for tre til seks måneder, og stort set al kode inden for tolv. Den deadline på tolv måneder udløb i marts. Næsten ingen gik tilbage for at tjekke.
Det er den mærkelige etikette omkring AI forudsigelser. Forudsigelserne er højlydte, daterede, og leveret med total selvsikkerhed, og så ankommer datoen og alle er gået videre til den næste. Der er ingen resultattavle. Så jeg byggede en.
I februar 2025 skitserede jeg agent workflows til Whizi ud fra antagelsen om, at Altman havde ret om 2025. Jeg droppede projektet seks uger senere, efter at have regnet på hvad en enkelt multistep agentkørsel koster mod et fast månedligt abonnement. Seks uger af min egen plan, brugt på en andens forudsigelse. Jeg samlede hver dateret 2024 og 2025 forudsigelse jeg kunne finde med en primær kilde og en deadline der allerede er passeret. Atten kom med.
Bedømmelsesreglen, så du kan diskutere den: en forudsigelse bedømmes op mod hvad dens egne ord lovede, på dens egen deadline. Hvis du sagde 90% inden september og september bragte 30%, er "jamen, engang" ikke en karakter. Det er en undskyldning.
Resultattavlen
| Hvem, hvornår | Forudsigelsen | Hvad der skete | Karakter |
|---|---|---|---|
| Sam Altman, januar 2025 | AI agenter "kommer ind i arbejdsstyrken" i 2025 | 95% af pilotprojekter i virksomheder viste ingen effekt på bundlinjen; den bedste agent fuldførte 30,3% af kontoropgaver | C- |
| Marc Benioff, september 2024 | En milliard Agentforce agenter inden udgangen af 2025 | Cirka 29.000 aftaler og $1B i årlig tilbagevendende omsætning | F |
| Klarna, februar 2024 | AI assistent der udfører arbejdet for 700 agenter | Genansætter mennesker fra maj 2025 for lavere kvalitet | C |
| Dario Amodei, marts 2025 | 90% af koden inden for tre til seks måneder | 25% til 41% på tværs af branchen, 75% hos Google midt i 2026 | C+ |
| Dario Amodei, marts 2025 | Stort set al kode inden for tolv måneder | Ikke tæt på | F |
| Eric Schmidt, april 2025 | Langt de fleste programmører erstattet inden for et år | Programmører stadig ansat; begynderstillinger ned omkring 16% | F |
| Mark Zuckerberg, januar 2025 | En AI mellemniveau-ingeniør, den førende milliardbruger-assistent, og Llama som den bedste model, alt sammen i 2025 | Ingen af de tre; rekordlønninger til menneskelige ingeniører i stedet | F |
| Elon Musk, april 2024 | AI klogere end noget menneske inden udgangen af 2025 | Grok 4 scorede 25,4% på Humanity's Last Exam | F |
| Mira Murati, juni 2024 | Ph.d.-niveau intelligens "for specifikke opgaver" om cirka 18 måneder | En certificeret guldmedalje ved International Math Olympiad 2025 | B- |
| Gary Marcus, januar 2025 | 25 daterede forudsigelser, fire bedømt her | Alle fire korrekte, og ingen af årets succeser på listen | A- |
Arbejdsstyrken der aldrig mødte op
Sam Altman, januar 2025: "Vi tror på, at vi i 2025 måske ser de første AI agenter 'komme ind i arbejdsstyrken' og markant ændre virksomheders output."
MIT's NANDA projekt fandt i august 2025, at 95% af virksomheders generative AI pilotprojekter ikke gav nogen målbar effekt på bundlinjen. Carnegie Mellon bemandede et fiktivt firma udelukkende med AI agenter og målte det kontorarbejde de fuldførte: den bedste model fuldførte 30,3% af opgaverne. En 30% medarbejder kommer ikke ind i din arbejdsstyrke. De forlader din prøvetid.
Én undtagelse redder dette fra et F: inden i softwarevirksomheder ændrede kodeagenter rent faktisk output. Karakter: C-.
Marc Benioff, september 2024: "Vores vision er dristig: at give en milliard agenter kraft med Agentforce inden udgangen af 2025."
Salesforce rapporterede omkring 29.000 samlede Agentforce aftaler i begyndelsen af 2026 og passerede $1B i årlig tilbagevendende omsætning. En rigtig forretning, og omkring 34.000 gange under løftet, tælt i aftaler frem for agenter. Min favoritdetalje: Salesforce rapporterer nu "agentic work units served" (3,8 milliarder af dem) i stedet for et antal agenter. Når man ikke kan ramme tallet, skifter man enheden. Karakter: F.
Klarna, februar 2024: deres AI assistent "udfører arbejdet svarende til 700 fuldtidsansatte agenter."
Så i maj 2025 vendte administrerende direktør Sebastian Siemiatkowski kursen og begyndte at genansætte mennesker: "Vi fokuserede for meget på effektivitet og omkostninger. Resultatet var lavere kvalitet." AI'en beholdt de rutinemæssige sager. Menneskerne kom tilbage til alt der betød noget. Ros for at køre eksperimentet offentligt og indrømme resultatet. Karakter: C.
Koden der rent faktisk blev skrevet
Amodeis 90%. Retningen var rigtig og nævneren var forkert. Google siger, at 75% af deres nye kode er AI-genereret pr. midt 2026, op fra 25% sidst i 2024, selvom det tæller hver accepteret autofuldførelse og mennesker stadig gennemgår før udrulning. Branchevide estimater i begyndelsen af 2026 lå typisk mellem 25% og 41%.
Så: 90% af al kode på seks måneder, nej. Stort set al kode på tolv, ikke tæt på. Et historisk skifte i hvordan kode skrives, absolut ja. Forudsigelsen beskrev en ægte revolution og fik hvert eneste tal forkert. Karakter: C+ for de 90%, F for "stort set alt."
Eric Schmidt, april 2025: "i løbet af det næste år vil langt de fleste programmører blive erstattet af AI programmører."
Året er gået. Programmører er stadig ansat næsten overalt, hvor de var ansat før. Den reelle skade på arbejdsmarkedet er snævrere og mere brutal end forudsigelsen: data fra Stanford og ADP lønsystemer viser, at beskæftigelsen for 22 til 25-årige i de mest AI-udsatte job er faldet cirka 16% siden slutningen af 2022 og stadig krymper. Begynderniveauet tog stødet; langt de fleste beholdt deres job og fik Copilot-licenser. Karakter: F.
Og tallet ingen forudsagde: Cursor gik fra $100M til $4B i årlig tilbagevendende omsætning på omkring sytten måneder, og den 14. august lukkede SpaceX deres opkøb af firmaet for $60B, det største opkøb af en startup nogensinde registreret. Ikke én 2024-forudsigelsesliste jeg tjekkede havde "en kodeeditor bliver den største startup-exit i historien" på listen.
Metas meget dyre år
Mark Zuckerberg, januar 2025, hos Joe Rogan: "Sandsynligvis i 2025 kommer vi hos Meta... til at have en AI der effektivt kan være en slags mellemniveau-ingeniør, man har i sin virksomhed, som kan skrive kode." På indtjeningsopkaldet nogle uger senere tilføjede han to mere for 2025: Meta AI som den førende milliardbruger-assistent, og Llama som den mest avancerede og mest udbredte model.
Ingen af de tre skete. Llama 4 landede med et brag, mens Gemini 3 tog forrangen i november 2025. Og Meta brugte året på at satse det modsatte med pengepungen: $14.3B for halvdelen af Scale AI, forskerlønninger rapporteret mellem $100M og $450M, og derefter 600 fyret fra superintelligens-laboratoriet i oktober og omkring 8.000 fyringer i maj 2026.
Meta forudsagde en AI der koder som en mellemniveau-ingeniør, og brugte i stedet atten måneder på at sætte verdensrekord i markedspris for menneskelige ingeniører. Karakter: F.
Elon Musk, april 2024: AI "klogere end noget som helst menneske, sandsynligvis omkring udgangen af næste år."
Ved udgangen af 2025 var flagskibsmodellen fra xAI Grok 4, lanceret som "den klogeste AI i verden", med en score på 25,4% på en benchmark der bogstaveligt hedder Humanity's Last Exam. Påstanden overlevede ikke mødet med eksamen. Karakter: F.
Mira Murati, juni 2024: Ph.d.-niveau intelligens "for specifikke opgaver" om cirka atten måneder.
For matematik skete det stort set: Google DeepMinds Deep Think tog en officielt certificeret guldmedalje ved International Math Olympiad 2025, år før de fleste 2024-forudsigelser. Forbeholdet hun brugte, "for specifikke opgaver", gør en stor del af arbejdet, og det er præcis det forbehold hendes højlydte kolleger nægtede at bruge. Den forsigtige version holdt stik. Den ubetingede version, lanceret som GPT-5's "Ph.d.-niveau" branding i august 2025, gik så galt, at Altman indrømmede, at OpenAI "totalt kvajede sig" med udrulningen. Karakter: B-.
Skeptikerens karakterbog
Gary Marcus udgav 25 daterede forudsigelser den 1. januar 2025. Branchen ruller mest med øjnene ad ham. Bedømmelse af hans bedømmelige påstande:
- "Vi vil ikke se kunstig generel intelligens i år." Korrekt.
- Agenter vil blive "hypet uafbrudt gennem 2025 men langt fra pålidelige." Korrekt, se hele det første afsnit.
- "Overskud fra AI-modeller vil fortsat være beskedent eller ikke-eksisterende." Omsætningen eksploderede, men han sagde overskud, og laboratorierne brænder stadig penge af. Korrekt efter bogstaven.
- Muligvis intet "GPT-5 niveau" konsensus-spring i 2025. GPT-5 blev lanceret; springet udeblev. Korrekt i ånden.
Karakter: A-. Fratrækket er for det listen ikke indeholder: intet i den forudsagde en $4B kodeværktøjskategori, en IMO-guldmedalje, eller agenter der bliver reelt nyttige på det ene område, hvor output kan tjekkes. Årets bedste spåmand forudsagde hver eneste fiasko og missede hver eneste succes.
Og den ubehagelige facts af anden orden: at have ret gav ham stort set intet. Investorerne der satsede imod hele hans verdensbillede er dem der prissatte Cursor til $60B. Forudsigelsesnøjagtighed og finansielt afkast kører på hver deres resultattavle, og kun den ene forrenter sig.
Kapacitetsforudsigelser holdt stik. Udrulningsforudsigelser gjorde ikke
Sorter de 18 forudsigelser i to bunker, og støjen forsvinder.
Forudsigelser om kapacitet, hvad modeller ville kunne, klarede sig godt og kom nogle gange tidligere end ventet. Længden af opgaver agenter kan fuldføre er blevet fordoblet cirka hver fjerde til syvende måned, ifølge METR, og trenden holdt.
Forudsigelser om udrulning, hvad organisationer faktisk ville lade AI gøre, fejlede næsten uden undtagelse. Arbejdsstyrke-agenter, milliard-agent platforme, erstattede programmører, AI-medarbejdere: alt sammen ramte den samme mur af kvalitetskrav, ansvar, integrationsomkostninger og det stædige faktum, at et system der fuldfører 30% af opgaverne er en demo, ikke en ansættelse.
Altman sagde agenter ville komme ind i arbejdsstyrken. De kom ind i IDE'en, fordi IDE'en er det ene arbejdssted, hvor et forkert svar bliver fanget af en compiler i stedet for en kunde.
Så her er beslutningsreglen jeg bruger nu, med mine egne penge på spil: når du hører en kapacitetsforudsigelse, tag den alvorligt, selv de vilde, fordi trendlinjerne bliver ved med at vinde. Når du hører en udrulningsforudsigelse med en dato på, fordobl tidslinjen, og tjek så hvad personen der siger det sælger. Den samme regel er hvordan jeg vælger hvilken model jeg betaler for: benchmarken er en kapacitetspåstand, arbejdsgangen er en udrulningspåstand.
Hvert kvartal herfra bedømmer jeg alt hvad der er forfaldet, og næste udgave starter med mine egne daterede forudsigelser, så du kan bedømme mig efter samme skala. At bedømme er gratis. At blive bedømt er prisen.
- Bedøm en forudsigelse op mod dens egne ord, på dens egen deadline; "engang" er ikke en karakter
- Tag kapacitetsforudsigelser alvorligt, selv de vilde; trendlinjerne bliver ved med at vinde
- Fordobl enhver udrulningstidslinje der har en dato
- Tjek hvad personen bag forudsigelsen sælger
- Skriv dine egne forudsigelser ned med datoer, så nogen kan bedømme dig tilbage
Ofte stillede spørgsmål
Havde Dario Amodei ret i, at AI ville skrive 90% af koden?
Ikke på hans deadline. Han sagde 90% inden for tre til seks måneder fra marts 2025 og stort set al kode inden for tolv. Branchevide estimater i begyndelsen af 2026 lå typisk mellem 25% og 41%, med Google på 75% af ny kode midt i 2026, tælt inklusive hver accepteret autofuldførelse. Retningen var rigtig, tallene var forkerte.
Kom AI agenter ind i arbejdsstyrken i 2025?
Ikke uden for software. MIT's NANDA projekt fandt, at 95% af virksomheders generative AI pilotprojekter ikke gav nogen målbar effekt på bundlinjen, og Carnegie Mellons agentfirma-test viste, at den bedste model fuldførte 30,3% af kontoropgaverne. Kodeagenter inden i softwarevirksomheder var den eneste reelle undtagelse.
Hvem forudsagde 2025 i AI mest præcist?
Gary Marcus, skeptikeren, på de påstande der bedømmes her: ingen AGI, agenter hypet men upålidelige, overskud stadig beskedent, intet konsensus GPT-5-spring. Alle fire holdt stik. Hans liste missede også hver eneste succes i året, fra $4B kodeværktøjskategorien til IMO-guldmedaljen.