کسانی که هوش مصنوعی می‌سازند، بدترین پیش‌بینی‌کننده‌های آن هستند

پاسخ سریع

هجده پیش‌بینی مورخ هوش مصنوعی از 2024 و 2025، بر اساس حرف‌های خودشان و در سررسید خودشان نمره‌دهی شدند. پیش‌بینی‌های توانمندی بیشتر درست از آب درآمدند، برخی زودتر از موعد. پیش‌بینی‌های استقرار، پیوستن عامل‌ها به نیروی کار، یک میلیارد عامل Agentforce، بیکاری برنامه‌نویسان ظرف یک سال، تقریباً همه شکست خوردند. بالاترین نمره را گری مارکوس شکاک با A- گرفت و درست بودن هیچ سودی برایش نداشت.

هیچ‌کس برنمی‌گردد که چک کند

در مارس 2025، داریو آمودی به شورای روابط خارجی گفت که هوش مصنوعی ظرف سه تا شش ماه 90 درصد کدها را خواهد نوشت و ظرف دوازده ماه تقریباً همه آن را. آن سررسید دوازده‌ماهه در مارس گذشت. تقریباً هیچ‌کس برنگشت که چک کند.

این آداب عجیب پیش‌بینی هوش مصنوعی است. پیش‌بینی‌ها بلند، مورخ و با اطمینان کامل ارائه می‌شوند، بعد تاریخ می‌رسد و همه به سراغ پیش‌بینی بعدی رفته‌اند. هیچ تابلوی امتیازی وجود ندارد. پس من یکی ساختم.

در فوریه 2025، من گردش‌کارهای عامل را در Whizi با این فرض که آلتمن درباره 2025 درست می‌گوید طراحی کردم. شش هفته بعد پروژه را متوقف کردم، بعد از اینکه هزینه یک اجرای چندمرحله‌ای عامل را در برابر یک اشتراک ماهانه ثابت حساب کردم. شش هفته از نقشه راه خودم، صرف پیش‌بینی کس دیگری شد. من هر پیش‌بینی مورخ 2024 و 2025 را که با منبع اصلی و سررسیدی که قبلاً گذشته باشد پیدا کردم جمع کردم. هجده مورد واجد شرایط شدند.

قانون نمره‌دهی، تا بتوانید با آن مخالفت کنید: یک پیش‌بینی بر اساس چیزی که حرف‌های خودش وعده داده، در سررسید خودش نمره می‌گیرد. اگر گفته‌اید 90 درصد تا سپتامبر و سپتامبر 30 درصد آورده، «خب، بالاخره» نمره نیست. بهانه است.

تابلوی امتیاز

چه کسی، چه زمانیپیش‌بینیچه اتفاقی افتادنمره
سم آلتمن، ژانویه 2025عامل‌های هوش مصنوعی «به نیروی کار می‌پیوندند» در 202595 درصد از پروژه‌های آزمایشی سازمانی هیچ تاثیر سود و زیانی نشان ندادند؛ بهترین عامل 30.3 درصد از وظایف اداری را تمام کردC-
مارک بنیوف، سپتامبر 2024یک میلیارد عامل Agentforce تا پایان 2025حدود 29,000 معامله و $1B درآمد سالانه تکرارشوندهF
کلارنا، فوریه 2024دستیار هوش مصنوعی معادل کار 700 نمایندهاستخدام مجدد انسان‌ها از می 2025 به دلیل کیفیت پایین‌ترC
داریو آمودی، مارس 202590 درصد کد ظرف سه تا شش ماه25 تا 41 درصد در سطح صنعت، 75 درصد در گوگل تا اواسط 2026C+
داریو آمودی، مارس 2025تقریباً همه کد ظرف دوازده ماهاصلاً نزدیک نبودF
اریک اشمیت، آوریل 2025اکثریت قریب به اتفاق برنامه‌نویسان ظرف یک سال بیکار می‌شوندبرنامه‌نویسان همچنان شاغل‌اند؛ نقش‌های ورودی حدود 16 درصد کاهش یافتهF
مارک زاکربرگ، ژانویه 2025یک مهندس میان‌رده هوش مصنوعی، پیشرو در دستیار یک‌میلیارد کاربره، و Llama به‌عنوان برترین مدل، همه در 2025هیچ‌کدام از این سه محقق نشد؛ به‌جایش دستمزدهای رکوردی برای مهندسان انسانیF
ایلان ماسک، آوریل 2024هوش مصنوعی باهوش‌تر از هر انسانی تا پایان 2025Grok 4 در Humanity's Last Exam نمره 25.4 درصد گرفتF
میرا موراتی، ژوئن 2024هوش سطح دکترا «برای وظایف خاص» ظرف حدود 18 ماهمدال طلای رسمی در المپیاد ریاضی بین‌المللی 2025B-
گری مارکوس، ژانویه 202525 پیش‌بینی مورخ، چهار مورد اینجا نمره‌گذاری شدهر چهار مورد درست، و هیچ‌کدام از موفقیت‌های سال در لیست نبودA-

نیروی کاری که هرگز کارت نزد

سم آلتمن، ژانویه 2025: «ما معتقدیم که در 2025 ممکن است اولین عامل‌های هوش مصنوعی 'به نیروی کار بپیوندند' و خروجی شرکت‌ها را به‌طور محسوسی تغییر دهند.»

پروژه NANDA در ام‌آی‌تی در آگوست 2025 دریافت که 95 درصد از پروژه‌های آزمایشی هوش مصنوعی مولد سازمانی هیچ تاثیر سود و زیان قابل‌اندازه‌گیری‌ای نداشتند. کارنگی ملون یک شرکت ساختگی را کاملاً با عامل‌های هوش مصنوعی پرسنل‌گذاری کرد و کار اداری‌ای را که تمام کردند اندازه گرفت: بهترین مدل 30.3 درصد وظایف را تمام کرد. یک کارمند 30 درصدی به نیروی کار شما نمی‌پیوندد. از دوره آزمایشی‌اش کنار می‌رود.

یک استثنا این را از نمره F نجات می‌دهد: در شرکت‌های نرم‌افزاری، عامل‌های کدنویسی واقعاً خروجی را تغییر دادند. نمره: C-.

مارک بنیوف، سپتامبر 2024: «چشم‌انداز ما جسورانه است: توانمندسازی یک میلیارد عامل با Agentforce تا پایان 2025.»

سیلزفورس تا اوایل 2026 حدود 29,000 معامله تجمعی Agentforce گزارش کرد و از مرز $1B درآمد سالانه تکرارشونده گذشت. یک کسب‌وکار واقعی، و حدود 34,000 برابر کمتر از وعده، با شمارش معاملات به‌جای عامل‌ها. جزئیات مورد علاقه من: سیلزفورس اکنون به‌جای شمارش عامل‌ها «واحدهای کار عامل‌محور ارائه‌شده» (3.8 میلیارد واحد) گزارش می‌دهد. وقتی نمی‌توانید به عدد برسید، واحد را عوض کنید. نمره: F.

کلارنا، فوریه 2024: دستیار هوش مصنوعی‌اش «معادل کار 700 نماینده تمام‌وقت را انجام می‌دهد.»

بعد در می 2025 مدیرعامل سباستین سیمیاتکوفسکی مسیر را برگرداند و شروع به استخدام مجدد انسان‌ها کرد: «ما بیش از حد روی کارایی و هزینه تمرکز کردیم. نتیجه کیفیت پایین‌تر بود.» هوش مصنوعی تیکت‌های روتین را نگه داشت. انسان‌ها برای هر چیزی که اهمیت داشت برگشتند. اعتبار برای اجرای علنی آزمایش و پذیرفتن نتیجه. نمره: C.

کدی که واقعاً نوشته شد

90 درصد آمودی. جهت درست بود و مخرج اشتباه. گوگل می‌گوید 75 درصد از کد جدیدش تا اواسط 2026 توسط هوش مصنوعی تولید می‌شود، در برابر 25 درصد در اواخر 2024، هرچند این شامل هر تکمیل خودکار پذیرفته‌شده می‌شود و انسان‌ها همچنان پیش از استقرار بازبینی می‌کنند. برآوردهای سطح صنعت در اوایل 2026 حدود 25 تا 41 درصد جمع شدند.

پس: 90 درصد همه کد ظرف شش ماه، نه. تقریباً همه کد ظرف دوازده ماه، اصلاً نزدیک نبود. یک تحول تاریخی در نحوه نوشتن کد، کاملاً بله. این پیش‌بینی یک انقلاب واقعی را توصیف کرد و همه اعداد را اشتباه گفت. نمره: C+ برای 90 درصد، F برای «تقریباً همه».

اریک اشمیت، آوریل 2025: «ظرف یک سال آینده، اکثریت قریب به اتفاق برنامه‌نویسان با برنامه‌نویسان هوش مصنوعی جایگزین می‌شوند.»

آن یک سال گذشته است. برنامه‌نویسان تقریباً همه‌جا که قبلاً شاغل بودند همچنان شاغل‌اند. آسیب واقعی به بازار کار محدودتر و بی‌رحمانه‌تر از پیش‌بینی است: داده‌های حقوق و دستمزد استنفورد و ADP نشان می‌دهند اشتغال افراد 22 تا 25 ساله در شغل‌های بیشتر در معرض هوش مصنوعی از اواخر 2022 حدود 16 درصد کاهش یافته و همچنان در حال کوچک‌شدن است. سطح ورودی ضربه خورد؛ اکثریت قریب به اتفاق شغل خود را حفظ کردند و مجوز Copilot گرفتند. نمره: F.

و عددی که اصلاً هیچ‌کس پیش‌بینی نکرد: Cursor ظرف حدود هفده ماه از $100M به $4B درآمد سالانه تکرارشونده رسید و در 14 اوت اسپیس‌ایکس خرید $60B شرکت را نهایی کرد، بزرگ‌ترین خرید استارتاپ ثبت‌شده تاکنون. هیچ لیست پیش‌بینی 2024 که من چک کردم «یک ویرایشگر کد به بزرگ‌ترین خروج استارتاپی تاریخ تبدیل می‌شود» نداشت.

سال بسیار پرهزینه Meta

مارک زاکربرگ، ژانویه 2025، در برنامه جو روگان: «احتمالاً در 2025، ما در Meta... قرار است هوش مصنوعی‌ای داشته باشیم که عملاً بتواند نوعی مهندس میان‌رده باشد که در شرکت‌تان دارید و می‌تواند کد بنویسد.» در تماس درآمدی چند هفته بعد دو مورد دیگر برای 2025 اضافه کرد: هوش مصنوعی Meta به‌عنوان دستیار پیشرو یک‌میلیارد کاربره، و Llama به‌عنوان پیشرفته‌ترین و پراستفاده‌ترین مدل.

هیچ‌کدام از این سه اتفاق نیفتاد. Llama 4 با شکست عرضه شد در حالی که Gemini 3 در نوامبر 2025 تاج پیشتاز را برد. و Meta سال را با شرط‌بندی معکوس با کیف پولش گذراند: $14.3B برای نیمی از Scale AI، بسته‌های دستمزد پژوهشگران بین $100M و $450M گزارش‌شده، سپس 600 نفر از آزمایشگاه ابرهوش در اکتبر و حدود 8,000 اخراج در می 2026.

Meta هوش مصنوعی‌ای پیش‌بینی کرد که مثل یک مهندس میان‌رده کد بزند، و به‌جایش هجده ماه صرف ثبت رکورد جهانی قیمت بازار برای مهندسان انسانی کرد. نمره: F.

ایلان ماسک، آوریل 2024: هوش مصنوعی «احتمالاً حدود پایان سال بعد باهوش‌تر از هر انسانی خواهد بود.»

تا پایان 2025، مدل پرچمدار xAI مدل Grok 4 بود، که به‌عنوان «باهوش‌ترین هوش مصنوعی جهان» عرضه شد و در معیاری به‌نام Humanity's Last Exam نمره 25.4 درصد گرفت. این ادعا در برابر آزمون دوام نیاورد. نمره: F.

میرا موراتی، ژوئن 2024: هوش سطح دکترا «برای وظایف خاص» ظرف حدود هجده ماه.

برای ریاضیات تقریباً محقق شد: Deep Think گوگل دیپ‌مایند مدال طلای رسمی تایید‌شده‌ای در المپیاد ریاضی بین‌المللی 2025 گرفت، سال‌ها زودتر از بیشتر پیش‌بینی‌های 2024. قید او، «برای وظایف خاص»، کار سنگینی انجام می‌دهد، و دقیقاً همان قیدی است که هMetaیان پرسروصداترش از به‌کاربردنش خودداری کردند. نسخه محتاطانه درست از آب درآمد. نسخه بدون قید، که در آگوست 2025 به‌عنوان برندسازی «سطح دکترا» جی‌پی‌تی-5 عرضه شد، به‌قدری بد پیش رفت که آلتمن پذیرفت OpenAI در راه‌اندازی آن «کاملاً خراب کرد». نمره: B-.

کارنامه شکاک

گری مارکوس در 1 ژانویه 2025، 25 پیش‌بینی مورخ منتشر کرد. صنعت اغلب او را دست‌کم می‌گیرد. نمره‌دهی به ادعاهای قابل‌ارزیابی‌اش:

  • «امسال شاهد هوش مصنوعی عمومی نخواهیم بود.» درست.
  • عامل‌ها «در سراسر 2025 بی‌وقفه تبلیغ می‌شوند اما از قابل‌اعتماد بودن دور می‌مانند.» درست، به کل بخش اول نگاه کنید.
  • «سود مدل‌های هوش مصنوعی همچنان متوسط یا ناچیز باقی خواهد ماند.» درآمد منفجر شد، اما او سود گفت، و آزمایشگاه‌ها همچنان پول می‌سوزانند. از نظر لفظی درست.
  • شاید بدون اجماع «سطح جی‌پی‌تی-5» در 2025. جی‌پی‌تی-5 عرضه شد؛ آن جهش رخ نداد. از نظر روحی درست.

نمره: A-. کسر منها به‌خاطر چیزی است که این لیست ندارد: هیچ‌چیز در آن دسته ابزار کدنویسی $4B، مدال طلای المپیاد، یا مفید شدن واقعی عامل‌ها در تنها حوزه‌ای که خروجی قابل‌بررسی است را پیش‌بینی نکرد. بهترین پیش‌بینی‌کننده 2025 هر شکستی را درست گفت و هر موفقیتی را از دست داد.

و واقعیت مرتبه دوم ناراحت‌کننده: درست بودن تقریباً هیچ سودی برایش نداشت. سرمایه‌گذارانی که در برابر کل جهان‌بینی او شرط بستند، همان‌هایی هستند که Cursor را $60B قیمت‌گذاری کردند. دقت پیش‌بینی و بازده مالی روی تابلوهای امتیاز جداگانه‌ای کار می‌کنند، و فقط یکی از آن‌ها رشد مرکب دارد.

پیش‌بینی‌های توانمندی درست شدند. پیش‌بینی‌های استقرار درست نشدند

18 پیش‌بینی را در دو دسته بچینید و آشفتگی ناپدید می‌شود.

پیش‌بینی‌های درباره توانمندی، اینکه مدل‌ها چه کاری می‌توانستند بکنند، خوب پیش رفتند و گاهی زودتر از موعد محقق شدند. طول وظایفی که عامل‌ها می‌توانند تمام کنند، طبق METR، هر چهار تا هفت ماه تقریباً دو برابر شده، و این روند ادامه یافت.

پیش‌بینی‌های درباره استقرار، اینکه سازمان‌ها اجازه می‌دهند هوش مصنوعی واقعاً چه کاری بکند، تقریباً همیشه شکست خوردند. عامل‌های کارگر، پلتفرم‌های میلیارد عاملی، برنامه‌نویسان جایگزین‌شده، کارمندان هوش مصنوعی: همه به همان دیوار استانداردهای کیفیت، مسئولیت‌پذیری، هزینه یکپارچه‌سازی و این واقعیت سرسخت برخوردند که سیستمی که 30 درصد وظایف را تمام می‌کند، یک نمایش است، نه یک استخدام.

آلتمن گفت عامل‌ها به نیروی کار می‌پیوندند. آن‌ها به IDE پیوستند، چون IDE تنها محیط کاری است که یک پاسخ اشتباه را کامپایلر می‌گیرد نه مشتری.

پس این قانون تصمیم‌گیری‌ای است که من الان با پول خودم به کار می‌گیرم: وقتی پیش‌بینی توانمندی می‌شنوید، آن را جدی بگیرید، حتی وحشیانه‌ترین‌هایش را، چون خطوط روند همچنان برنده می‌شوند. وقتی پیش‌بینی استقرار با تاریخ می‌شنوید، بازه زمانی را دو برابر کنید، سپس ببینید گوینده چه چیزی می‌فروشد. همین قانون روشی است که من مدل موردنظرم برای پول دادن را انتخاب می‌کنم: معیار عملکرد یک ادعای توانمندی است، گردش‌کار یک ادعای استقرار است.

از این به بعد هر فصل هرچه سررسید می‌شود را نمره می‌دهم، و شماره بعدی با پیش‌بینی‌های مورخ خودم شروع می‌شود، تا بتوانید مرا از همان معیار عبور دهید. نمره‌دادن رایگان است. نمره‌گرفتن قیمت دارد.

فهرست بررسی
  • یک پیش‌بینی را بر اساس حرف‌های خودش، در سررسید خودش نمره بدهید؛ «بالاخره» نمره نیست
  • پیش‌بینی‌های توانمندی را جدی بگیرید، حتی وحشیانه‌ترین‌ها را؛ خطوط روند همچنان برنده می‌شوند
  • هر بازه زمانی استقرار که تاریخ دارد را دو برابر کنید
  • ببینید گوینده پیش‌بینی چه چیزی می‌فروشد
  • پیش‌بینی‌های خودتان را با تاریخ بنویسید تا کسی بتواند شما را نمره بدهد

پرسش‌های متداول

آیا داریو آمودی درست گفت که هوش مصنوعی 90 درصد کد را می‌نویسد؟

نه در سررسیدش. او گفت 90 درصد ظرف سه تا شش ماه از مارس 2025 و تقریباً همه کد ظرف دوازده ماه. برآوردهای سطح صنعت در اوایل 2026 حدود 25 تا 41 درصد جمع شدند، با گوگل در 75 درصد از کد جدید تا اواسط 2026 که هر تکمیل خودکار پذیرفته‌شده را می‌شمارد. جهت درست بود و اعداد اشتباه.

آیا عامل‌های هوش مصنوعی در 2025 به نیروی کار پیوستند؟

خارج از نرم‌افزار، نه. پروژه NANDA در ام‌آی‌تی دریافت 95 درصد از پروژه‌های آزمایشی هوش مصنوعی مولد سازمانی هیچ تاثیر سود و زیان قابل‌اندازه‌گیری‌ای نداشتند، و آزمون شرکت عامل کارنگی ملون دید بهترین مدل 30.3 درصد وظایف اداری را تمام کرد. عامل‌های کدنویسی در شرکت‌های نرم‌افزاری تنها استثنای واقعی بودند.

چه کسی 2025 هوش مصنوعی را دقیق‌ترین پیش‌بینی کرد؟

گری مارکوس شکاک، بر اساس ادعاهایی که اینجا نمره‌دهی شد: بدون هوش مصنوعی عمومی، عامل‌های پرتبلیغ اما نامعتبر، سود همچنان متوسط، بدون اجماع جهش جی‌پی‌تی-5. هر چهار مورد درست ماند. لیست او همچنین هر موفقیت سال را از دسته ابزار کدنویسی $4B تا مدال طلای المپیاد از دست داد.