Yapay zekayı inşa edenler, onu tahmin etmekte en kötü olanlar

Hızlı yanıt

2024 ve 2025'ten 18 tarihli yapay zeka tahmini, kendi sözlerine ve kendi son tarihlerine göre notlandırıldı. Yetenek tahminleri büyük ölçüde doğru çıktı, hatta bazıları erken gerçekleşti. Dağıtım tahminleri, ajanların iş gücüne katılması, bir milyar Agentforce ajanı, bir yıl içinde yerini alan programcılar, neredeyse tamamen başarısız oldu. En yüksek notu alan kişi, şüpheci Gary Marcus oldu ve A- aldı; haklı çıkmak ona hiçbir şey kazandırmadı.

Kimse geri dönüp kontrol etmiyor

Mart 2025'te Dario Amodei, Council on Foreign Relations'a yapay zekanın üç ila altı ay içinde kodun %90'ını yazacağını, on iki ay içinde ise neredeyse tamamını yazacağını söyledi. O on iki aylık son tarih Mart'ta doldu. Neredeyse kimse geri dönüp kontrol etmedi.

Yapay zeka tahminciliğinin tuhaf görgü kuralı budur. Tahminler yüksek sesle, tarihli ve tam bir güvenle sunulur, sonra o tarih gelir ve herkes bir sonrakine geçmiş olur. Bir skor tablosu yoktur. Ben de bir tane yaptım.

Şubat 2025'te Altman'ın 2025 hakkında haklı olduğu varsayımıyla Whizi içine ajan iş akışlarını planladım. Tek bir çok adımlı ajan çalışmasının maliyetini sabit bir aylık aboneliğe karşı hesapladıktan altı hafta sonra projeyi durdurdum. Kendi yol haritamdan altı hafta, başkasının tahminine harcanmış oldu. Birincil kaynağı ve süresi zaten dolmuş bir son tarihi olan bulabildiğim her 2024 ve 2025 tahminini topladım. On sekiz tanesi eleğimden geçti.

Notlandırma kuralı, itiraz edebilesiniz diye açık: bir tahmin, kendi sözlerinin vaat ettiğine göre, kendi son tarihinde notlandırılır. Eylüle kadar %90 dediyseniz ve Eylül %30 getirdiyse, "eninde sonunda" bir not değildir. Bir bahanedir.

Skor tablosu

Kim, ne zamanTahminNe olduNot
Sam Altman, Ocak 2025Yapay zeka ajanları 2025'te "iş gücüne katılıyor"Kurumsal pilotların %95'i kâr zarar üzerinde etki göstermedi; en iyi ajan ofis görevlerinin %30,3'ünü tamamladıC-
Marc Benioff, Eylül 20242025 sonuna kadar bir milyar Agentforce ajanıYaklaşık 29.000 anlaşma ve $1B yıllık yinelenen gelirF
Klarna, Şubat 2024700 temsilcinin işini yapan yapay zeka asistanıMayıs 2025'ten itibaren düşük kalite nedeniyle insanları yeniden işe almaya başladıC
Dario Amodei, Mart 2025Üç ila altı ayda kodun %90'ıSektör genelinde %25 ile %41 arası, 2026 ortasında Google'da %75C+
Dario Amodei, Mart 2025On iki ayda kodun neredeyse tamamıHiç yakın değilF
Eric Schmidt, Nisan 2025Bir yıl içinde programcıların büyük çoğunluğunun yerini yapay zeka programcıları alacakProgramcılar hâlâ çalışıyor; giriş seviyesi roller yaklaşık %16 azaldıF
Mark Zuckerberg, Ocak 2025Orta düzey bir yapay zeka mühendisi, lider bir milyar kullanıcılı asistan ve en iyi model olarak Llama, hepsi 2025'teÜçü de gerçekleşmedi; bunun yerine insan mühendisler için rekor maaş paketleriF
Elon Musk, Nisan 20242025 sonuna kadar herhangi bir insandan daha zeki yapay zekaGrok 4, Humanity's Last Exam'de %25,4 puan aldıF
Mira Murati, Haziran 2024Yaklaşık 18 ayda "belirli görevler için" doktora düzeyinde zeka2025 Uluslararası Matematik Olimpiyatı'nda onaylı bir altın madalyaB-
Gary Marcus, Ocak 202525 tarihli tahmin, burada dördü notlandırıldıDördü de doğru, ve yılın başarılarından hiçbiri listede yokA-

Hiç işe başlamayan iş gücü

Sam Altman, Ocak 2025: "2025'te ilk yapay zeka ajanlarının 'iş gücüne katılmasını' ve şirketlerin çıktısını maddi olarak değiştirmesini görebileceğimize inanıyoruz."

MIT'nin NANDA projesi, Ağustos 2025'te kurumsal üretken yapay zeka pilotlarının %95'inin ölçülebilir bir kâr zarar etkisi üretmediğini buldu. Carnegie Mellon, tamamen yapay zeka ajanlarından oluşan sahte bir şirket kurdu ve tamamlanan ofis işlerini ölçtü: en iyi model görevlerin %30,3'ünü tamamladı. %30 performans gösteren bir çalışan iş gücünüze katılmaz. Deneme süresinden çıkarılır.

Bunu F'den kurtaran bir istisna var: yazılım şirketleri içinde kodlama ajanları çıktıyı gerçekten değiştirdi. Not: C-.

Marc Benioff, Eylül 2024: "Vizyonumuz cesur: 2025 sonuna kadar Agentforce ile bir milyar ajanı güçlendirmek."

Salesforce, 2026 başı itibarıyla kümülatif olarak yaklaşık 29.000 Agentforce anlaşması bildirdi ve $1B yıllık yinelenen gelire ulaştı. Gerçek bir iş, ve ajan yerine anlaşma sayılsa bile vaadin yaklaşık 34.000 kat gerisinde. En sevdiğim ayrıntı: Salesforce artık ajan sayısı yerine "sunulan ajan çalışma birimleri" (3,8 milyar tanesi) bildiriyor. Sayıyı tutturamayınca birimi değiştir. Not: F.

Klarna, Şubat 2024: yapay zeka asistanı "700 tam zamanlı temsilcinin eşdeğer işini yapıyor."

Sonra Mayıs 2025'te CEO Sebastian Siemiatkowski yön değiştirdi ve insanları yeniden işe almaya başladı: "Verimlilik ve maliyete çok fazla odaklandık. Sonuç düşük kalite oldu." Yapay zeka rutin talepleri elinde tuttu. Önemli olan her şey için insanlar geri döndü. Deneyi herkesin önünde yürütüp sonucu kabul ettiği için puan alıyor. Not: C.

Gerçekten yazılan kod

Amodei'nin %90'ı. Yön doğruydu, payda yanlıştı. Google, 2026 ortası itibarıyla yeni kodunun %75'inin yapay zeka tarafından üretildiğini söylüyor; bu oran 2024 sonundaki %25'ten yükseldi, ancak bu her kabul edilen otomatik tamamlamayı sayıyor ve insanlar devreye almadan önce hâlâ inceliyor. 2026 başında sektör genelindeki tahminler %25 ile %41 arasında kümelendi.

Yani: altı ayda tüm kodun %90'ı, hayır. On iki ayda neredeyse tamamı, hiç yakın değil. Kodun yazılma biçiminde tarihi bir değişim, kesinlikle evet. Tahmin gerçek bir devrimi tarif etti ve her sayıyı yanlış aldı. Not: %90 için C+, "neredeyse tamamı" için F.

Eric Schmidt, Nisan 2025: "önümüzdeki bir yıl içinde, programcıların büyük çoğunluğunun yerini yapay zeka programcıları alacak."

O bir yıl doldu. Programcılar, daha önce çalıştıkları hemen her yerde çalışmaya devam ediyor. Gerçek işgücü hasarı, tahminden daha dar ve daha acımasız: Stanford ve ADP bordro verileri, yapay zekaya en açık işlerde 22 ila 25 yaş arası çalışanların istihdamının 2022 sonundan bu yana yaklaşık %16 düştüğünü ve hâlâ küçüldüğünü gösteriyor. Darbeyi giriş seviyesi aldı; büyük çoğunluk işini korudu ve Copilot lisansı aldı. Not: F.

Ve kimsenin hiç tahmin etmediği sayı: Cursor, yaklaşık on yedi ayda yıllık yinelenen gelirini $100M'dan $4B'a çıkardı ve 14 Ağustos'ta SpaceX, şirketin $60B'lık satın alımını tamamladı; bu, kayıtlara geçen en büyük girişim satın alımı oldu. İncelediğim hiçbir 2024 tahmin listesinde "bir kod editörü tarihin en büyük girişim çıkışı olur" yazmıyordu.

Meta'nın çok pahalı yılı

Mark Zuckerberg, Ocak 2025, Joe Rogan'da: "Muhtemelen 2025'te, Meta'da... kod yazabilen, şirketinizde bulunan orta düzey bir mühendis gibi etkili çalışan bir yapay zekamız olacak." Haftalar sonra kazanç görüşmesinde 2025 için iki tahmin daha ekledi: lider bir milyar kullanıcılı asistan olarak Meta AI ve en gelişmiş, en yaygın kullanılan model olarak Llama.

Üçünden hiçbiri gerçekleşmedi. Llama 4 sessiz sedasız çıktı, Kasım 2025'te Gemini 3 sınırı ele geçirdi. Ve Meta, yılı cüzdanıyla tam tersi bir bahis oynayarak geçirdi: Scale AI'nin yarısı için $14.3B, $100M ile $450M arasında bildirilen araştırmacı maaş paketleri, ardından Ekim'de süper zeka laboratuvarından 600 kişinin çıkarılması ve Mayıs 2026'da yaklaşık 8.000 işten çıkarma.

Meta, orta düzey bir mühendis gibi kod yazan bir yapay zeka öngördü ve bunun yerine on sekiz ay boyunca insanlar için dünya rekoru maaş fiyatlarını belirledi. Not: F.

Elon Musk, Nisan 2024: yapay zeka "muhtemelen gelecek yılın sonunda herhangi bir insandan daha zeki olacak."

2025 sonu itibarıyla xAI'nin amiral gemisi modeli, "dünyanın en akıllı yapay zekası" olarak lanse edilen Grok 4'tü ve tam olarak Humanity's Last Exam adlı bir kıyaslamada %25,4 puan aldı. İddia, sınavla temas ettiğinde hayatta kalamadı. Not: F.

Mira Murati, Haziran 2024: yaklaşık on sekiz ayda "belirli görevler için" doktora düzeyinde zeka.

Matematik için neredeyse gerçekleşti: Google DeepMind'ın Deep Think'i, 2025 Uluslararası Matematik Olimpiyatı'nda resmi olarak onaylı bir altın madalya aldı; bu, çoğu 2024 tahmininden yıllar önceydi. Kullandığı "belirli görevler için" niteleyicisi ağır iş görüyor ve tam olarak daha yüksek sesli meslektaşlarının kullanmayı reddettiği niteleyici bu. Yumuşatılmış versiyon gerçekleşti. Niteliksiz versiyon, Ağustos 2025'te GPT-5'in "doktora düzeyi" pazarlaması olarak sunulduğunda o kadar kötü gitti ki Altman, OpenAI'nin lansmanı "resmen batırdığını" kabul etti. Not: B-.

Şüphecinin karnesi

Gary Marcus, 1 Ocak 2025'te 25 tarihli tahmin yayınladı. Sektör genellikle onunla dalga geçer. Notlandırılabilir iddialarını notlandıralım:

  • "Bu yıl yapay genel zeka görmeyeceğiz." Doğru.
  • Ajanlar "2025 boyunca sonsuza dek hype yapılacak ama güvenilir olmaktan uzak kalacak." Doğru, tüm ilk bölüme bakın.
  • "Yapay zeka modellerinden gelen kârlar ılımlı veya sıfır olmaya devam edecek." Gelir patladı ama o kâr dedi ve laboratuvarlar hâlâ nakit yakıyor. Harfiyen doğru.
  • 2025'te muhtemelen "GPT-5 düzeyinde" bir fikir birliği sıçraması olmayacak. GPT-5 çıktı; sıçrama olmadı. Ruh olarak doğru.

Not: A-. Kırılan eksi, listenin içermediği şeyler için: $4B'lık bir kodlama aracı kategorisi, bir Uluslararası Matematik Olimpiyatı altını veya çıktının denetlenebilir olduğu tek alanda ajanların gerçekten kullanışlı hale gelmesi listede yoktu. 2025'in en iyi tahmincisi her başarısızlığı doğru bildi ve her başarıyı kaçırdı.

Ve rahatsız edici ikinci düzey gerçek: haklı çıkmak ona neredeyse hiçbir şey kazandırmadı. Onun tüm dünya görüşüne karşı bahis oynayan yatırımcılar, Cursor'u $60B'a fiyatlayanlar oldu. Tahmin doğruluğu ve finansal getiri ayrı skor tablolarında işliyor ve yalnızca biri bileşik büyüyor.

Yetenek tahminleri doğru çıktı. Dağıtım tahminleri çıkmadı

18 tahmini iki yığına ayırın, gürültü kaybolsun.

Modellerin neler yapabileceğine dair yetenek tahminleri iyi yaşlandı ve bazen erken gerçekleşti. METR'e göre ajanların tamamlayabildiği görevlerin uzunluğu kabaca her dört ila yedi ayda bir katlanıyor ve bu eğilim sürdü.

Kuruluşların yapay zekaya gerçekten ne yaptırtacağına dair dağıtım tahminleri neredeyse tamamen başarısız oldu. İş gücü ajanları, milyar ajanlı platformlar, yerini alan programcılar, yapay zeka çalışanları: hepsi aynı duvara çarptı; kalite eşikleri, sorumluluk, entegrasyon maliyeti ve görevlerin %30'unu tamamlayan bir sistemin bir işe alım değil bir demo olduğu inatçı gerçeği.

Altman, ajanların iş gücüne katılacağını söyledi. Onlar IDE'ye katıldı, çünkü IDE, yanlış bir cevabın bir müşteri yerine bir derleyici tarafından yakalandığı tek iş yeri.

İşte şimdi kendi paramı ortaya koyarak kullandığım karar kuralı: bir yetenek tahmini duyduğunuzda, en çılgın olanları bile, ciddiye alın, çünkü eğilim çizgileri kazanmaya devam ediyor. Tarih taşıyan bir dağıtım tahmini duyduğunuzda, zaman çizelgesini ikiye katlayın, sonra bunu söyleyen kişinin ne sattığına bakın. Aynı kural, hangi modele para vereceğimi seçme yöntemim: kıyaslama bir yetenek iddiası, iş akışı ise bir dağıtım iddiasıdır.

Buradan itibaren her çeyrekte vadesi gelen her şeyi notlandıracağım ve bir sonraki sayı kendi tarihli tahminlerimle açılacak, böylece beni de aynı ölçütten geçirebilirsiniz. Notlandırmak ücretsiz. Notlandırılmak ise bedeli.

Kontrol listesi
  • Bir tahmini kendi sözlerine göre, kendi son tarihinde notlandırın; "eninde sonunda" bir not değildir
  • En çılgın olanları bile, yetenek tahminlerini ciddiye alın; eğilim çizgileri kazanmaya devam ediyor
  • Tarih taşıyan her dağıtım zaman çizelgesini ikiye katlayın
  • Tahmini yapan kişinin ne sattığına bakın
  • Kendi tahminlerinizi tarihleriyle yazın ki biri sizi de notlandırabilsin

Sık sorulan sorular

Dario Amodei'nin yapay zeka kodun %90'ını yazacak tahmini doğru muydu?

Kendi son tarihinde değil. Mart 2025'ten itibaren üç ila altı ayda %90 ve on iki ayda kodun neredeyse tamamını söylemişti. 2026 başında sektör genelindeki tahminler %25 ile %41 arasında kümelendi; Google, 2026 ortasına kadar yeni kodunun %75'ini, her kabul edilen otomatik tamamlamayı sayarak bildirdi. Yön doğruydu, sayılar yanlıştı.

Yapay zeka ajanları 2025'te iş gücüne katıldı mı?

Yazılım dışında değil. MIT'nin NANDA projesi, kurumsal üretken yapay zeka pilotlarının %95'inin ölçülebilir bir kâr zarar etkisi üretmediğini buldu ve Carnegie Mellon'un ajan şirketi testinde en iyi model ofis görevlerinin %30,3'ünü tamamladı. Yazılım şirketleri içindeki kodlama ajanları gerçek istisnaydı.

2025'i yapay zekada en doğru kim tahmin etti?

Şüpheci Gary Marcus, burada notlandırılan iddialarına göre: AGI yok, ajanlar hype yaptı ama güvenilmezdi, kârlar hâlâ ılımlı, GPT-5 fikir birliği sıçraması yok. Dördü de tuttu. Listesi ayrıca yılın $4B'lık kodlama aracı kategorisinden Uluslararası Matematik Olimpiyatı altınına kadar her başarıyı kaçırdı.