Nikdo se k tomu nevrací
V březnu 2025 řekl Dario Amodei Radě pro zahraniční vztahy (Council on Foreign Relations), že AI bude do tří až šesti měsíců psát 90 % kódu a do dvanácti měsíců v podstatě všechen. Ten dvanáctiměsíční termín uplynul v březnu. Skoro nikdo se k tomu nevrátil.
Taková je zvláštní etiketa předpovídání AI. Předpovědi jsou hlasité, datované a podávané s naprostou jistotou, a pak nastane termín a všichni už jsou u další předpovědi. Žádná tabulka výsledků neexistuje. Tak jsem ji postavil.
V únoru 2025 jsem navrhl do Whizi agentní pracovní postupy v předpokladu, že Altman měl pravdu ohledně roku 2025. O šest týdnů později jsem projekt zabil, poté co jsem spočítal, kolik stojí jeden vícekrokový běh agenta oproti paušálnímu měsíčnímu předplatnému. Šest týdnů vlastního plánu utracených na cizí předpovědi. Vytáhl jsem každou datovanou předpověď z let 2024 a 2025, kterou jsem našel s primárním zdrojem a termínem, jenž už uplynul. Prošlo osmnáct.
Pravidlo hodnocení, abyste se se mnou mohli přít: předpověď se hodnotí podle toho, co slíbila vlastními slovy, na vlastní termín. Pokud jste řekli 90 % do září a září přineslo 30 %, „no, časem“ není známka. Je to výmluva.
Výsledková tabulka
| Kdo, kdy | Předpověď | Co se stalo | Známka |
|---|---|---|---|
| Sam Altman, leden 2025 | AI agenti „vstoupí do pracovní síly“ v roce 2025 | 95 % firemních pilotních projektů bez dopadu na zisk; nejlepší agent dokončil 30,3 % kancelářských úkolů | C- |
| Marc Benioff, září 2024 | Miliarda agentů Agentforce do konce roku 2025 | Zhruba 29 000 obchodů a $1B ročního opakovaného příjmu | F |
| Klarna, únor 2024 | AI asistent dělá práci 700 agentů | Od května 2025 znovu nabírá lidi kvůli nižší kvalitě | C |
| Dario Amodei, březen 2025 | 90 % kódu do tří až šesti měsíců | 25 až 41 % napříč odvětvím, 75 % u Google do poloviny 2026 | C+ |
| Dario Amodei, březen 2025 | V podstatě všechen kód do dvanácti měsíců | Ani zdaleka | F |
| Eric Schmidt, duben 2025 | Naprostá většina programátorů nahrazena do roka | Programátoři zůstávají zaměstnaní; juniorní pozice klesly asi o 16 % | F |
| Mark Zuckerberg, leden 2025 | AI středně pokročilý inženýr, vedoucí asistent s miliardou uživatelů a Llama jako nejlepší model, to vše v roce 2025 | Nic z toho tří; místo toho rekordní platy pro lidské inženýry | F |
| Elon Musk, duben 2024 | AI chytřejší než kterýkoli člověk do konce roku 2025 | Grok 4 dosáhl 25,4 % v testu Humanity's Last Exam | F |
| Mira Murati, červen 2024 | Inteligence na úrovni doktorátu „pro konkrétní úkoly“ přibližně za 18 měsíců | Certifikované zlato na Mezinárodní matematické olympiádě 2025 | B- |
| Gary Marcus, leden 2025 | 25 datovaných předpovědí, čtyři zde ohodnocené | Všechny čtyři správně, a žádný z letošních úspěchů na seznamu | A- |
Pracovní síla, která se nikdy nedostavila
Sam Altman, leden 2025: „Věříme, že v roce 2025 uvidíme první AI agenty, kteří ‚vstoupí do pracovní síly‘ a hmatatelně změní výstup firem.“
Projekt NANDA na MIT zjistil v srpnu 2025, že 95 % firemních pilotních projektů generativní AI nemělo měřitelný dopad na zisk. Carnegie Mellon obsadila fiktivní firmu výhradně AI agenty a měřila, kolik kancelářské práce dokončí: nejlepší model dokončil 30,3 % úkolů. Zaměstnanec s 30% úspěšností nevstupuje do vaší pracovní síly. Odchází ze zkušební doby.
Jedna výjimka to zachraňuje před pětkou: uvnitř softwarových firem skutečně agenti pro programování změnili výstup. Známka: C-.
Marc Benioff, září 2024: „Naší odvážnou vizí je posílit miliardu agentů pomocí Agentforce do konce roku 2025.“
Salesforce vykázal zhruba 29 000 kumulativních obchodů Agentforce začátkem roku 2026 a překročil $1B ročního opakovaného příjmu. Skutečný byznys, ale zhruba 34 000krát méně, než bylo slíbeno, a to počítáme obchody, ne agenty. Můj oblíbený detail: Salesforce nyní vykazuje „agentic work units served“ (3,8 miliardy z nich) místo počtu agentů. Když nejde trefit číslo, změní se jednotka. Známka: F.
Klarna, únor 2024: její AI asistent „dělá ekvivalent práce 700 zaměstnanců na plný úvazek“.
Pak v květnu 2025 generální ředitel Sebastian Siemiatkowski otočil kurz a začal znovu nabírat lidi: „Příliš jsme se soustředili na efektivitu a náklady. Výsledkem byla nižší kvalita.“ AI si ponechala rutinní tikety. Lidé se vrátili ke všemu, na čem záleželo. Uznání za to, že experiment proběhl veřejně a výsledek byl přiznán. Známka: C.
Kód, který se skutečně napsal
Amodeiho 90 %. Směr byl správný a jmenovatel špatný. Google uvádí, že 75 % jeho nového kódu je do poloviny roku 2026 vygenerováno AI, oproti 25 % koncem roku 2024, i když to zahrnuje každý přijatý návrh automatického doplňování a lidé stále kontrolují před nasazením. Odhady napříč odvětvím na začátku roku 2026 se pohybovaly kolem 25 až 41 %.
Takže: 90 % veškerého kódu za šest měsíců, ne. V podstatě všechen kód za dvanáct, ani zdaleka. Historický posun v tom, jak se kód píše, absolutně ano. Předpověď popsala skutečnou revoluci a netrefila jediné číslo. Známka: C+ za 90 %, F za „v podstatě všechno“.
Eric Schmidt, duben 2025: „v příštím roce bude naprostá většina programátorů nahrazena AI programátory.“
Rok uplynul. Programátoři zůstávají zaměstnaní téměř všude, kde byli zaměstnaní předtím. Skutečná škoda na trhu práce je užší a krutější, než předpověď naznačovala: data ze Stanfordu a mzdová data ADP ukazují, že zaměstnanost lidí ve věku 22 až 25 let v profesích nejvíce vystavených AI klesla od konce roku 2022 zhruba o 16 % a stále klesá. Zasáhlo to juniorní pozice, naprostá většina si práci udržela a dostala licence na Copilot. Známka: F.
A číslo, které nepředpověděl vůbec nikdo: Cursor vyrostl z $100M na $4B ročního opakovaného příjmu za zhruba sedmnáct měsíců, a 14. srpna dokončil SpaceX akvizici této firmy za $60B, největší zaznamenanou akvizici startupu vůbec. Ani jeden seznam předpovědí z roku 2024, který jsem prošel, neobsahoval „editor kódu se stane největším startupovým exitem v historii“.
Velmi drahý rok Meta
Mark Zuckerberg, leden 2025, u Joea Rogana: „Pravděpodobně v roce 2025 budeme mít v Meta... AI, která může efektivně fungovat jako středně pokročilý inženýr ve vaší firmě, jenž píše kód.“ Na výsledkovém hovoru o pár týdnů později přidal další dva sliby pro rok 2025: Meta AI jako vedoucí asistent s miliardou uživatelů a Llama jako nejpokročilejší a nejpoužívanější model.
Nic z toho tří se nestalo. Llama 4 dopadla s žuchnutím, zatímco Gemini 3 v listopadu 2025 převzal korunu nejlepšího modelu. A Meta strávila rok opačnou sázkou se svou peněženkou: $14.3B za polovinu Scale AI, platy výzkumníků hlášené v rozmezí $100M až $450M, poté v říjnu propuštění 600 lidí z laboratoře superinteligence a v květnu 2026 zhruba 8 000 dalších propuštění.
Meta předpověděla AI, která píše kód jako středně pokročilý inženýr, a místo toho strávila osmnáct měsíců nastavováním světového rekordu v cenách lidských inženýrů. Známka: F.
Elon Musk, duben 2024: AI „chytřejší než kterýkoli jednotlivý člověk, pravděpodobně kolem konce příštího roku“.
Do konce roku 2025 byl vlajkovým modelem xAI Grok 4, uvedený jako „nejchytřejší AI na světě“, se skóre 25,4 % v benchmarku doslova nazvaném Humanity's Last Exam. Toto tvrzení nepřežilo setkání se zkouškou. Známka: F.
Mira Murati, červen 2024: inteligence na úrovni doktorátu „pro konkrétní úkoly“ přibližně za osmnáct měsíců.
V matematice se to v podstatě naplnilo: Deep Think od Google DeepMind získal oficiálně certifikované zlato na Mezinárodní matematické olympiádě 2025, roky před většinou předpovědí z roku 2024. Kvalifikátor, který použila, „pro konkrétní úkoly“, dělá těžkou práci a je to přesně ten kvalifikátor, který její hlasitější kolegové odmítli použít. Podmíněná verze se naplnila. Nepodmíněná verze, prodávaná jako značka „PhD-level“ u GPT-5 v srpnu 2025, dopadla natolik špatně, že Altman přiznal, že OpenAI „to se spuštěním úplně zvorala“. Známka: B-.
Vysvědčení skeptika
Gary Marcus zveřejnil 25 datovaných předpovědí 1. ledna 2025. Odvětví nad ním většinou kroutí očima. Hodnocení jeho hodnotitelných tvrzení:
- „Letos neuvidíme obecnou umělou inteligenci.“ Správně.
- Agenti budou „po celý rok 2025 nekonečně přehnaně vychvalováni, ale zdaleka ne spolehliví“. Správně, viz celá první sekce.
- „Zisky z AI modelů zůstanou nadále skromné nebo žádné.“ Příjmy explodovaly, ale on mluvil o ziscích, a laboratoře stále spalují hotovost. Správně doslovně.
- Možná žádný konsenzuální skok na úroveň „GPT-5“ v roce 2025. GPT-5 vyšel, skok se nekonal. Správně v duchu.
Známka: A-. Odečtené minus je za to, co seznam neobsahuje: nic v něm nepředpovědělo kategorii kódovacích nástrojů za $4B, zlato z IMO nebo agenty, kteří se stanou skutečně užitečnými v jedné doméně, kde je výstup ověřitelný. Nejlepší hodnotitel roku 2025 trefil každé selhání a minul každý úspěch.
A nepříjemný fakt druhého řádu: pravda mu vynesla přibližně nic. Investoři, kteří vsadili proti celému jeho pohledu na svět, jsou přesně ti, kdo ocenili Cursor na $60B. Přesnost předpovědí a finanční výnosy běží na oddělených tabulkách výsledků a jen jedna z nich se zúročuje.
Předpovědi o schopnostech se naplnily. Předpovědi o nasazení ne
Roztřiďte těch 18 předpovědí do dvou hromádek a šum zmizí.
Předpovědi o schopnostech, tedy o tom, co modely dokážou, obstály dobře a někdy přišly i dřív. Délka úkolů, které agenti dokážou dokončit, se podle METR zdvojnásobuje zhruba každé čtyři až sedm měsíců, a trend se potvrdil.
Předpovědi o nasazení, tedy o tom, co firmy skutečně dovolí AI dělat, selhaly téměř všechny. Pracovní agenti, platformy s miliardou agentů, nahrazení programátoři, AI zaměstnanci: to vše narazilo na stejnou zeď kvalitativních měřítek, odpovědnosti, nákladů na integraci a tvrdohlavého faktu, že systém dokončující 30 % úkolů je demo, ne zaměstnanec.
Altman řekl, že agenti vstoupí do pracovní síly. Vstoupili do IDE, protože IDE je jediné pracoviště, kde špatnou odpověď odchytí kompilátor, ne zákazník.
Takže tady je rozhodovací pravidlo, které teď používám, s vlastními penězi ve hře: když uslyšíte předpověď o schopnostech, berte ji vážně, i ty divoké, protože trendové křivky pořád vyhrávají. Když uslyšíte předpověď o nasazení s připojeným datem, zdvojnásobte časový rámec a pak si ověřte, co ten, kdo to říká, zrovna prodává. Stejné pravidlo používám při výběru, za jaký model platit: benchmark je tvrzení o schopnosti, pracovní postup je tvrzení o nasazení.
Každé čtvrtletí odteď ohodnotím vše, co dozraje, a další vydání otevřu vlastními datovanými předpověďmi, takže mě můžete provést stejným hodnocením. Hodnotit je zdarma. Být hodnocen má svou cenu.
- Hodnoťte předpověď podle jejích vlastních slov, na její vlastní termín; „časem“ není známka
- Berte předpovědi o schopnostech vážně, i ty divoké; trendové křivky pořád vyhrávají
- Zdvojnásobte jakýkoli časový rámec nasazení, který nese datum
- Ověřte si, co ten, kdo předpověď dělá, zrovna prodává
- Zapisujte si vlastní předpovědi s daty, aby vás mohl někdo zpětně ohodnotit
Časté dotazy
Měl Dario Amodei pravdu, že AI bude psát 90 % kódu?
Ne ve svém termínu. Řekl 90 % do tří až šesti měsíců od března 2025 a v podstatě všechen kód do dvanácti. Odhady napříč odvětvím na začátku roku 2026 se pohybovaly kolem 25 až 41 %, přičemž Google uváděl 75 % nového kódu do poloviny 2026, počítaje každý přijatý návrh automatického doplňování. Směr byl správný, čísla ne.
Vstoupili AI agenti v roce 2025 do pracovní síly?
Mimo software ne. Projekt NANDA na MIT zjistil, že 95 % firemních pilotních projektů generativní AI nemělo měřitelný dopad na zisk, a test agentní firmy na Carnegie Mellon ukázal, že nejlepší model dokončil 30,3 % kancelářských úkolů. Agenti pro programování uvnitř softwarových firem byli jedinou skutečnou výjimkou.
Kdo předpověděl rok 2025 v oblasti AI nejpřesněji?
Gary Marcus, skeptik, pokud jde o zde hodnocená tvrzení: žádná AGI, agenti přehnaně vychvalovaní ale nespolehliví, zisky stále skromné, žádný konsenzuální skok na úroveň GPT-5. Všechny čtyři vyšly. Jeho seznam ale také minul každý úspěch roku, od kategorie kódovacích nástrojů za $4B po zlato z IMO.