هیچکس برنمیگردد که چک کند
در مارس 2025، داریو آمودی به شورای روابط خارجی گفت که هوش مصنوعی ظرف سه تا شش ماه 90 درصد کدها را خواهد نوشت و ظرف دوازده ماه تقریباً همه آن را. آن سررسید دوازدهماهه در مارس گذشت. تقریباً هیچکس برنگشت که چک کند.
این آداب عجیب پیشبینی هوش مصنوعی است. پیشبینیها بلند، مورخ و با اطمینان کامل ارائه میشوند، بعد تاریخ میرسد و همه به سراغ پیشبینی بعدی رفتهاند. هیچ تابلوی امتیازی وجود ندارد. پس من یکی ساختم.
در فوریه 2025، من گردشکارهای عامل را در Whizi با این فرض که آلتمن درباره 2025 درست میگوید طراحی کردم. شش هفته بعد پروژه را متوقف کردم، بعد از اینکه هزینه یک اجرای چندمرحلهای عامل را در برابر یک اشتراک ماهانه ثابت حساب کردم. شش هفته از نقشه راه خودم، صرف پیشبینی کس دیگری شد. من هر پیشبینی مورخ 2024 و 2025 را که با منبع اصلی و سررسیدی که قبلاً گذشته باشد پیدا کردم جمع کردم. هجده مورد واجد شرایط شدند.
قانون نمرهدهی، تا بتوانید با آن مخالفت کنید: یک پیشبینی بر اساس چیزی که حرفهای خودش وعده داده، در سررسید خودش نمره میگیرد. اگر گفتهاید 90 درصد تا سپتامبر و سپتامبر 30 درصد آورده، «خب، بالاخره» نمره نیست. بهانه است.
تابلوی امتیاز
| چه کسی، چه زمانی | پیشبینی | چه اتفاقی افتاد | نمره |
|---|---|---|---|
| سم آلتمن، ژانویه 2025 | عاملهای هوش مصنوعی «به نیروی کار میپیوندند» در 2025 | 95 درصد از پروژههای آزمایشی سازمانی هیچ تاثیر سود و زیانی نشان ندادند؛ بهترین عامل 30.3 درصد از وظایف اداری را تمام کرد | C- |
| مارک بنیوف، سپتامبر 2024 | یک میلیارد عامل Agentforce تا پایان 2025 | حدود 29,000 معامله و $1B درآمد سالانه تکرارشونده | F |
| کلارنا، فوریه 2024 | دستیار هوش مصنوعی معادل کار 700 نماینده | استخدام مجدد انسانها از می 2025 به دلیل کیفیت پایینتر | C |
| داریو آمودی، مارس 2025 | 90 درصد کد ظرف سه تا شش ماه | 25 تا 41 درصد در سطح صنعت، 75 درصد در گوگل تا اواسط 2026 | C+ |
| داریو آمودی، مارس 2025 | تقریباً همه کد ظرف دوازده ماه | اصلاً نزدیک نبود | F |
| اریک اشمیت، آوریل 2025 | اکثریت قریب به اتفاق برنامهنویسان ظرف یک سال بیکار میشوند | برنامهنویسان همچنان شاغلاند؛ نقشهای ورودی حدود 16 درصد کاهش یافته | F |
| مارک زاکربرگ، ژانویه 2025 | یک مهندس میانرده هوش مصنوعی، پیشرو در دستیار یکمیلیارد کاربره، و Llama بهعنوان برترین مدل، همه در 2025 | هیچکدام از این سه محقق نشد؛ بهجایش دستمزدهای رکوردی برای مهندسان انسانی | F |
| ایلان ماسک، آوریل 2024 | هوش مصنوعی باهوشتر از هر انسانی تا پایان 2025 | Grok 4 در Humanity's Last Exam نمره 25.4 درصد گرفت | F |
| میرا موراتی، ژوئن 2024 | هوش سطح دکترا «برای وظایف خاص» ظرف حدود 18 ماه | مدال طلای رسمی در المپیاد ریاضی بینالمللی 2025 | B- |
| گری مارکوس، ژانویه 2025 | 25 پیشبینی مورخ، چهار مورد اینجا نمرهگذاری شد | هر چهار مورد درست، و هیچکدام از موفقیتهای سال در لیست نبود | A- |
نیروی کاری که هرگز کارت نزد
سم آلتمن، ژانویه 2025: «ما معتقدیم که در 2025 ممکن است اولین عاملهای هوش مصنوعی 'به نیروی کار بپیوندند' و خروجی شرکتها را بهطور محسوسی تغییر دهند.»
پروژه NANDA در امآیتی در آگوست 2025 دریافت که 95 درصد از پروژههای آزمایشی هوش مصنوعی مولد سازمانی هیچ تاثیر سود و زیان قابلاندازهگیریای نداشتند. کارنگی ملون یک شرکت ساختگی را کاملاً با عاملهای هوش مصنوعی پرسنلگذاری کرد و کار اداریای را که تمام کردند اندازه گرفت: بهترین مدل 30.3 درصد وظایف را تمام کرد. یک کارمند 30 درصدی به نیروی کار شما نمیپیوندد. از دوره آزمایشیاش کنار میرود.
یک استثنا این را از نمره F نجات میدهد: در شرکتهای نرمافزاری، عاملهای کدنویسی واقعاً خروجی را تغییر دادند. نمره: C-.
مارک بنیوف، سپتامبر 2024: «چشمانداز ما جسورانه است: توانمندسازی یک میلیارد عامل با Agentforce تا پایان 2025.»
سیلزفورس تا اوایل 2026 حدود 29,000 معامله تجمعی Agentforce گزارش کرد و از مرز $1B درآمد سالانه تکرارشونده گذشت. یک کسبوکار واقعی، و حدود 34,000 برابر کمتر از وعده، با شمارش معاملات بهجای عاملها. جزئیات مورد علاقه من: سیلزفورس اکنون بهجای شمارش عاملها «واحدهای کار عاملمحور ارائهشده» (3.8 میلیارد واحد) گزارش میدهد. وقتی نمیتوانید به عدد برسید، واحد را عوض کنید. نمره: F.
کلارنا، فوریه 2024: دستیار هوش مصنوعیاش «معادل کار 700 نماینده تماموقت را انجام میدهد.»
بعد در می 2025 مدیرعامل سباستین سیمیاتکوفسکی مسیر را برگرداند و شروع به استخدام مجدد انسانها کرد: «ما بیش از حد روی کارایی و هزینه تمرکز کردیم. نتیجه کیفیت پایینتر بود.» هوش مصنوعی تیکتهای روتین را نگه داشت. انسانها برای هر چیزی که اهمیت داشت برگشتند. اعتبار برای اجرای علنی آزمایش و پذیرفتن نتیجه. نمره: C.
کدی که واقعاً نوشته شد
90 درصد آمودی. جهت درست بود و مخرج اشتباه. گوگل میگوید 75 درصد از کد جدیدش تا اواسط 2026 توسط هوش مصنوعی تولید میشود، در برابر 25 درصد در اواخر 2024، هرچند این شامل هر تکمیل خودکار پذیرفتهشده میشود و انسانها همچنان پیش از استقرار بازبینی میکنند. برآوردهای سطح صنعت در اوایل 2026 حدود 25 تا 41 درصد جمع شدند.
پس: 90 درصد همه کد ظرف شش ماه، نه. تقریباً همه کد ظرف دوازده ماه، اصلاً نزدیک نبود. یک تحول تاریخی در نحوه نوشتن کد، کاملاً بله. این پیشبینی یک انقلاب واقعی را توصیف کرد و همه اعداد را اشتباه گفت. نمره: C+ برای 90 درصد، F برای «تقریباً همه».
اریک اشمیت، آوریل 2025: «ظرف یک سال آینده، اکثریت قریب به اتفاق برنامهنویسان با برنامهنویسان هوش مصنوعی جایگزین میشوند.»
آن یک سال گذشته است. برنامهنویسان تقریباً همهجا که قبلاً شاغل بودند همچنان شاغلاند. آسیب واقعی به بازار کار محدودتر و بیرحمانهتر از پیشبینی است: دادههای حقوق و دستمزد استنفورد و ADP نشان میدهند اشتغال افراد 22 تا 25 ساله در شغلهای بیشتر در معرض هوش مصنوعی از اواخر 2022 حدود 16 درصد کاهش یافته و همچنان در حال کوچکشدن است. سطح ورودی ضربه خورد؛ اکثریت قریب به اتفاق شغل خود را حفظ کردند و مجوز Copilot گرفتند. نمره: F.
و عددی که اصلاً هیچکس پیشبینی نکرد: Cursor ظرف حدود هفده ماه از $100M به $4B درآمد سالانه تکرارشونده رسید و در 14 اوت اسپیسایکس خرید $60B شرکت را نهایی کرد، بزرگترین خرید استارتاپ ثبتشده تاکنون. هیچ لیست پیشبینی 2024 که من چک کردم «یک ویرایشگر کد به بزرگترین خروج استارتاپی تاریخ تبدیل میشود» نداشت.
سال بسیار پرهزینه Meta
مارک زاکربرگ، ژانویه 2025، در برنامه جو روگان: «احتمالاً در 2025، ما در Meta... قرار است هوش مصنوعیای داشته باشیم که عملاً بتواند نوعی مهندس میانرده باشد که در شرکتتان دارید و میتواند کد بنویسد.» در تماس درآمدی چند هفته بعد دو مورد دیگر برای 2025 اضافه کرد: هوش مصنوعی Meta بهعنوان دستیار پیشرو یکمیلیارد کاربره، و Llama بهعنوان پیشرفتهترین و پراستفادهترین مدل.
هیچکدام از این سه اتفاق نیفتاد. Llama 4 با شکست عرضه شد در حالی که Gemini 3 در نوامبر 2025 تاج پیشتاز را برد. و Meta سال را با شرطبندی معکوس با کیف پولش گذراند: $14.3B برای نیمی از Scale AI، بستههای دستمزد پژوهشگران بین $100M و $450M گزارششده، سپس 600 نفر از آزمایشگاه ابرهوش در اکتبر و حدود 8,000 اخراج در می 2026.
Meta هوش مصنوعیای پیشبینی کرد که مثل یک مهندس میانرده کد بزند، و بهجایش هجده ماه صرف ثبت رکورد جهانی قیمت بازار برای مهندسان انسانی کرد. نمره: F.
ایلان ماسک، آوریل 2024: هوش مصنوعی «احتمالاً حدود پایان سال بعد باهوشتر از هر انسانی خواهد بود.»
تا پایان 2025، مدل پرچمدار xAI مدل Grok 4 بود، که بهعنوان «باهوشترین هوش مصنوعی جهان» عرضه شد و در معیاری بهنام Humanity's Last Exam نمره 25.4 درصد گرفت. این ادعا در برابر آزمون دوام نیاورد. نمره: F.
میرا موراتی، ژوئن 2024: هوش سطح دکترا «برای وظایف خاص» ظرف حدود هجده ماه.
برای ریاضیات تقریباً محقق شد: Deep Think گوگل دیپمایند مدال طلای رسمی تاییدشدهای در المپیاد ریاضی بینالمللی 2025 گرفت، سالها زودتر از بیشتر پیشبینیهای 2024. قید او، «برای وظایف خاص»، کار سنگینی انجام میدهد، و دقیقاً همان قیدی است که هMetaیان پرسروصداترش از بهکاربردنش خودداری کردند. نسخه محتاطانه درست از آب درآمد. نسخه بدون قید، که در آگوست 2025 بهعنوان برندسازی «سطح دکترا» جیپیتی-5 عرضه شد، بهقدری بد پیش رفت که آلتمن پذیرفت OpenAI در راهاندازی آن «کاملاً خراب کرد». نمره: B-.
کارنامه شکاک
گری مارکوس در 1 ژانویه 2025، 25 پیشبینی مورخ منتشر کرد. صنعت اغلب او را دستکم میگیرد. نمرهدهی به ادعاهای قابلارزیابیاش:
- «امسال شاهد هوش مصنوعی عمومی نخواهیم بود.» درست.
- عاملها «در سراسر 2025 بیوقفه تبلیغ میشوند اما از قابلاعتماد بودن دور میمانند.» درست، به کل بخش اول نگاه کنید.
- «سود مدلهای هوش مصنوعی همچنان متوسط یا ناچیز باقی خواهد ماند.» درآمد منفجر شد، اما او سود گفت، و آزمایشگاهها همچنان پول میسوزانند. از نظر لفظی درست.
- شاید بدون اجماع «سطح جیپیتی-5» در 2025. جیپیتی-5 عرضه شد؛ آن جهش رخ نداد. از نظر روحی درست.
نمره: A-. کسر منها بهخاطر چیزی است که این لیست ندارد: هیچچیز در آن دسته ابزار کدنویسی $4B، مدال طلای المپیاد، یا مفید شدن واقعی عاملها در تنها حوزهای که خروجی قابلبررسی است را پیشبینی نکرد. بهترین پیشبینیکننده 2025 هر شکستی را درست گفت و هر موفقیتی را از دست داد.
و واقعیت مرتبه دوم ناراحتکننده: درست بودن تقریباً هیچ سودی برایش نداشت. سرمایهگذارانی که در برابر کل جهانبینی او شرط بستند، همانهایی هستند که Cursor را $60B قیمتگذاری کردند. دقت پیشبینی و بازده مالی روی تابلوهای امتیاز جداگانهای کار میکنند، و فقط یکی از آنها رشد مرکب دارد.
پیشبینیهای توانمندی درست شدند. پیشبینیهای استقرار درست نشدند
18 پیشبینی را در دو دسته بچینید و آشفتگی ناپدید میشود.
پیشبینیهای درباره توانمندی، اینکه مدلها چه کاری میتوانستند بکنند، خوب پیش رفتند و گاهی زودتر از موعد محقق شدند. طول وظایفی که عاملها میتوانند تمام کنند، طبق METR، هر چهار تا هفت ماه تقریباً دو برابر شده، و این روند ادامه یافت.
پیشبینیهای درباره استقرار، اینکه سازمانها اجازه میدهند هوش مصنوعی واقعاً چه کاری بکند، تقریباً همیشه شکست خوردند. عاملهای کارگر، پلتفرمهای میلیارد عاملی، برنامهنویسان جایگزینشده، کارمندان هوش مصنوعی: همه به همان دیوار استانداردهای کیفیت، مسئولیتپذیری، هزینه یکپارچهسازی و این واقعیت سرسخت برخوردند که سیستمی که 30 درصد وظایف را تمام میکند، یک نمایش است، نه یک استخدام.
آلتمن گفت عاملها به نیروی کار میپیوندند. آنها به IDE پیوستند، چون IDE تنها محیط کاری است که یک پاسخ اشتباه را کامپایلر میگیرد نه مشتری.
پس این قانون تصمیمگیریای است که من الان با پول خودم به کار میگیرم: وقتی پیشبینی توانمندی میشنوید، آن را جدی بگیرید، حتی وحشیانهترینهایش را، چون خطوط روند همچنان برنده میشوند. وقتی پیشبینی استقرار با تاریخ میشنوید، بازه زمانی را دو برابر کنید، سپس ببینید گوینده چه چیزی میفروشد. همین قانون روشی است که من مدل موردنظرم برای پول دادن را انتخاب میکنم: معیار عملکرد یک ادعای توانمندی است، گردشکار یک ادعای استقرار است.
از این به بعد هر فصل هرچه سررسید میشود را نمره میدهم، و شماره بعدی با پیشبینیهای مورخ خودم شروع میشود، تا بتوانید مرا از همان معیار عبور دهید. نمرهدادن رایگان است. نمرهگرفتن قیمت دارد.
- یک پیشبینی را بر اساس حرفهای خودش، در سررسید خودش نمره بدهید؛ «بالاخره» نمره نیست
- پیشبینیهای توانمندی را جدی بگیرید، حتی وحشیانهترینها را؛ خطوط روند همچنان برنده میشوند
- هر بازه زمانی استقرار که تاریخ دارد را دو برابر کنید
- ببینید گوینده پیشبینی چه چیزی میفروشد
- پیشبینیهای خودتان را با تاریخ بنویسید تا کسی بتواند شما را نمره بدهد
پرسشهای متداول
آیا داریو آمودی درست گفت که هوش مصنوعی 90 درصد کد را مینویسد؟
نه در سررسیدش. او گفت 90 درصد ظرف سه تا شش ماه از مارس 2025 و تقریباً همه کد ظرف دوازده ماه. برآوردهای سطح صنعت در اوایل 2026 حدود 25 تا 41 درصد جمع شدند، با گوگل در 75 درصد از کد جدید تا اواسط 2026 که هر تکمیل خودکار پذیرفتهشده را میشمارد. جهت درست بود و اعداد اشتباه.
آیا عاملهای هوش مصنوعی در 2025 به نیروی کار پیوستند؟
خارج از نرمافزار، نه. پروژه NANDA در امآیتی دریافت 95 درصد از پروژههای آزمایشی هوش مصنوعی مولد سازمانی هیچ تاثیر سود و زیان قابلاندازهگیریای نداشتند، و آزمون شرکت عامل کارنگی ملون دید بهترین مدل 30.3 درصد وظایف اداری را تمام کرد. عاملهای کدنویسی در شرکتهای نرمافزاری تنها استثنای واقعی بودند.
چه کسی 2025 هوش مصنوعی را دقیقترین پیشبینی کرد؟
گری مارکوس شکاک، بر اساس ادعاهایی که اینجا نمرهدهی شد: بدون هوش مصنوعی عمومی، عاملهای پرتبلیغ اما نامعتبر، سود همچنان متوسط، بدون اجماع جهش جیپیتی-5. هر چهار مورد درست ماند. لیست او همچنین هر موفقیت سال را از دسته ابزار کدنویسی $4B تا مدال طلای المپیاد از دست داد.