যারা AI বানাচ্ছে, তারাই এটার ভবিষ্যদ্বাণীতে সবচেয়ে খারাপ

দ্রুত উত্তর

2024 আর 2025 থেকে আঠারোটা তারিখযুক্ত AI ভবিষ্যদ্বাণী, নিজেদের কথা আর নিজেদের ডেডলাইন ধরে গ্রেড করা হয়েছে। ক্যাপাবিলিটি পূর্বাভাস বেশিরভাগই সত্যি হয়েছে, কিছু তো আগেভাগেই। ডিপ্লয়মেন্ট পূর্বাভাস, এজেন্ট ওয়ার্কফোর্সে যোগ দেওয়া, এক বিলিয়ন Agentforce এজেন্ট, এক বছরে প্রোগ্রামার বদলে যাওয়া, প্রায় সবই ব্যর্থ হয়েছে। সবচেয়ে বেশি নম্বর পেয়েছেন সংশয়বাদী Gary Marcus, A- নিয়ে, আর সঠিক হয়ে তিনি কিছুই পাননি।

কেউ ফিরে গিয়ে চেক করে না

2025 সালের মার্চে, Dario Amodei Council on Foreign Relations কে বলেছিলেন যে AI তিন থেকে ছয় মাসের মধ্যে 90% কোড লিখবে, আর বারো মাসের মধ্যে প্রায় সবটাই। সেই বারো মাসের ডেডলাইন মার্চে পার হয়ে গেছে। প্রায় কেউই ফিরে গিয়ে চেক করেনি।

এটাই AI পূর্বাভাসের অদ্ভুত রীতি। ভবিষ্যদ্বাণীগুলো জোরালো, তারিখযুক্ত, আর পুরো আত্মবিশ্বাসের সাথে দেওয়া, তারপর তারিখ চলে আসে আর সবাই পরের ভবিষ্যদ্বাণীতে চলে যায়। কোনো স্কোরবোর্ড নেই। তাই আমি একটা বানালাম।

2025 সালের ফেব্রুয়ারিতে, আমি Whizi তে এজেন্ট ওয়ার্কফ্লো স্কোপ করেছিলাম এই ধারণায় যে Altman 2025 সম্পর্কে ঠিক বলছিলেন। ছয় সপ্তাহ পর প্রজেক্টটা বাতিল করলাম, একটা মাল্টিস্টেপ এজেন্ট রান একটা ফ্ল্যাট মাসিক সাবস্ক্রিপশনের তুলনায় কত খরচ হয় তার হিসাব করার পর। আমার নিজের রোডম্যাপের ছয় সপ্তাহ, অন্য কারো পূর্বাভাসে খরচ হলো। আমি প্রাইমারি সোর্স আর ইতিমধ্যে পার হয়ে যাওয়া ডেডলাইনসহ 2024 আর 2025 এর প্রতিটা তারিখযুক্ত ভবিষ্যদ্বাণী খুঁজে বের করেছি। আঠারোটা তালিকায় জায়গা পেয়েছে।

গ্রেডিংয়ের নিয়ম, যাতে আপনি তর্ক করতে পারেন: একটা ভবিষ্যদ্বাণী তার নিজের কথা যা প্রতিশ্রুতি দিয়েছিল, নিজের ডেডলাইনে সেই অনুযায়ী গ্রেড করা হয়। আপনি যদি বলেন সেপ্টেম্বরের মধ্যে 90%, আর সেপ্টেম্বরে আসে 30%, তাহলে "ঠিক আছে, একসময়" কোনো গ্রেড না। এটা একটা অজুহাত।

স্কোরবোর্ড

কে, কখনভবিষ্যদ্বাণীকী ঘটলোগ্রেড
Sam Altman, জানুয়ারি 2025AI এজেন্টরা 2025 সালে "ওয়ার্কফোর্সে যোগ দেবে"95% এন্টারপ্রাইজ পাইলটে কোনো P&L প্রভাব ছিল না; সেরা এজেন্ট অফিসের 30.3% কাজ শেষ করেছেC-
Marc Benioff, সেপ্টেম্বর 20242025 সালের শেষ নাগাদ এক বিলিয়ন Agentforce এজেন্টপ্রায় 29,000টা ডিল আর $1B বার্ষিক পুনরাবৃত্ত আয়F
Klarna, ফেব্রুয়ারি 2024700 জন এজেন্টের কাজ করছে AI অ্যাসিস্ট্যান্ট2025 সালের মে থেকে কম মানের কারণে মানুষ আবার নিয়োগC
Dario Amodei, মার্চ 2025তিন থেকে ছয় মাসের মধ্যে 90% কোডইন্ডাস্ট্রিজুড়ে 25% থেকে 41%, 2026 এর মাঝামাঝি Google এ 75%C+
Dario Amodei, মার্চ 2025বারো মাসের মধ্যে প্রায় সব কোডধারেকাছেও নাF
Eric Schmidt, এপ্রিল 2025এক বছরের মধ্যে বেশিরভাগ প্রোগ্রামার বদলে যাবেপ্রোগ্রামাররা এখনো কর্মরত; এন্ট্রি লেভেল রোল প্রায় 16% কমF
Mark Zuckerberg, জানুয়ারি 2025একটা AI মিডলেভেল ইঞ্জিনিয়ার, শীর্ষস্থানীয় বিলিয়ন ইউজারের অ্যাসিস্ট্যান্ট, আর Llama সেরা মডেল হিসেবে, সবই 2025 সালেতিনটার একটাও না; বরং মানুষ ইঞ্জিনিয়ারদের জন্য রেকর্ড বেতন প্যাকেজF
Elon Musk, এপ্রিল 20242025 এর শেষ নাগাদ যেকোনো মানুষের চেয়ে বুদ্ধিমান AIGrok 4 Humanity's Last Exam এ 25.4% স্কোর করেছেF
Mira Murati, জুন 2024প্রায় 18 মাসে "নির্দিষ্ট কাজের জন্য" PhD লেভেলের বুদ্ধিমত্তা2025 International Math Olympiad এ সার্টিফায়েড গোল্ডB-
Gary Marcus, জানুয়ারি 202525টা তারিখযুক্ত ভবিষ্যদ্বাণী, এখানে চারটা গ্রেড করাচারটাই সঠিক, আর তালিকায় বছরের একটা সাফল্যও নেইA-

যে ওয়ার্কফোর্স কখনো ক্লক ইন করেনি

Sam Altman, জানুয়ারি 2025: "আমরা বিশ্বাস করি, 2025 সালে, আমরা হয়তো প্রথম AI এজেন্টগুলোকে 'ওয়ার্কফোর্সে যোগ দিতে' দেখব আর কোম্পানিগুলোর আউটপুট বস্তুগতভাবে পাল্টে যাবে।"

MIT এর NANDA প্রজেক্ট 2025 সালের আগস্টে দেখেছে যে 95% এন্টারপ্রাইজ জেনারেটিভ AI পাইলট কোনো পরিমাপযোগ্য P&L প্রভাব তৈরি করেনি। Carnegie Mellon পুরোপুরি AI এজেন্ট দিয়ে একটা নকল কোম্পানি চালিয়ে অফিসের কাজ পরিমাপ করেছে: সেরা মডেল 30.3% কাজ শেষ করেছে। 30% কর্মী আপনার ওয়ার্কফোর্সে যোগ দেয় না। তারা প্রবেশন পিরিয়ডে বিদায় নেয়।

একটা ব্যতিক্রম একে F থেকে বাঁচায়: সফটওয়্যার কোম্পানির ভেতরে, কোডিং এজেন্ট সত্যিই আউটপুট পাল্টে দিয়েছে। গ্রেড: C-।

Marc Benioff, সেপ্টেম্বর 2024: "আমাদের ভিশন সাহসী: 2025 সালের শেষ নাগাদ Agentforce দিয়ে এক বিলিয়ন এজেন্টকে ক্ষমতায়ন করা।"

Salesforce 2026 সালের শুরুতে প্রায় 29,000টা সঞ্চিত Agentforce ডিলের কথা জানিয়েছে আর $1B বার্ষিক পুনরাবৃত্ত আয় পার করেছে। একটা আসল ব্যবসা, প্রতিশ্রুতির চেয়ে প্রায় 34,000 গুণ কম, এজেন্টের বদলে ডিল গুনে। আমার প্রিয় ডিটেইল: Salesforce এখন এজেন্টের সংখ্যার বদলে "এজেন্টিক ওয়ার্ক ইউনিট সার্ভড" (3.8 বিলিয়ন) রিপোর্ট করে। সংখ্যায় পোষালে না, ইউনিট পাল্টে ফেলো। গ্রেড: F।

Klarna, ফেব্রুয়ারি 2024: এর AI অ্যাসিস্ট্যান্ট "700 জন ফুল-টাইম এজেন্টের সমতুল্য কাজ করছে।"

তারপর 2025 সালের মে মাসে CEO Sebastian Siemiatkowski সিদ্ধান্ত পাল্টে মানুষ আবার নিয়োগ শুরু করেন: "আমরা এফিশিয়েন্সি আর খরচের ওপর অতিরিক্ত মনোযোগ দিয়েছিলাম। ফলাফল ছিল কম মান।" AI রুটিন টিকিটগুলো রেখেছিল। যা গুরুত্বপূর্ণ ছিল তার জন্য মানুষ ফিরে এসেছিল। জনসমক্ষে এই পরীক্ষা চালানো আর ফলাফল স্বীকার করার জন্য কৃতিত্ব প্রাপ্য। গ্রেড: C।

যে কোড সত্যিই লেখা হয়েছিল

Amodei এর 90%। দিকনির্দেশনা ঠিক ছিল, হর ভুল ছিল। Google বলছে 2026 এর মাঝামাঝি নাগাদ এর নতুন কোডের 75% AI জেনারেটেড, 2024 এর শেষের দিকে 25% থেকে বেড়ে, যদিও এতে প্রতিটা গৃহীত অটোকমপ্লিট গোনা হয়েছে আর মানুষ এখনো ডিপ্লয়ের আগে রিভিউ করে। 2026 এর শুরুতে ইন্ডাস্ট্রিজুড়ে অনুমান 25% থেকে 41% এর মধ্যে জড়ো হয়েছে।

তাহলে: ছয় মাসে সব কোডের 90%, না। বারো মাসে প্রায় সব কোড, ধারেকাছেও না। কোড লেখার পদ্ধতিতে একটা ঐতিহাসিক পরিবর্তন, একেবারে হ্যাঁ। ভবিষ্যদ্বাণীটা একটা আসল বিপ্লবের কথা বলেছিল আর প্রতিটা সংখ্যা ভুল করেছিল। গ্রেড: 90% এর জন্য C+, "প্রায় সবটা" এর জন্য F।

Eric Schmidt, এপ্রিল 2025: "আগামী এক বছরে, বেশিরভাগ প্রোগ্রামার AI প্রোগ্রামার দিয়ে বদলে যাবে।"

বছর শেষ। প্রোগ্রামাররা প্রায় সবখানেই আগের মতো কর্মরত আছেন। আসল শ্রম ক্ষতি ভবিষ্যদ্বাণীর চেয়ে সংকীর্ণ আর নিষ্ঠুর: Stanford আর ADP পেরোল ডেটা দেখাচ্ছে সবচেয়ে বেশি AI প্রভাবিত কাজে 22 থেকে 25 বছর বয়সীদের কর্মসংস্থান 2022 এর শেষ থেকে প্রায় 16% কমেছে আর এখনো কমছে। এন্ট্রি লেভেল আঘাত পেয়েছে; বেশিরভাগই তাদের চাকরি রেখেছে আর Copilot লাইসেন্স পেয়েছে। গ্রেড: F।

আর যে সংখ্যাটা কেউ ভবিষ্যদ্বাণী করেনি: Cursor প্রায় সতেরো মাসে $100M থেকে $4B বার্ষিক পুনরাবৃত্ত আয়ে পৌঁছেছে, আর 14 আগস্ট SpaceX $60B এ কোম্পানিটা অধিগ্রহণ করেছে, ইতিহাসের সবচেয়ে বড় স্টার্টআপ অধিগ্রহণ। আমি যে 2024 এর কোনো ভবিষ্যদ্বাণী তালিকা চেক করেছি তাতে "একটা কোড এডিটর ইতিহাসের সবচেয়ে বড় স্টার্টআপ এক্সিট হয়ে উঠবে" এমন কিছু নেই।

Meta এর অনেক ব্যয়বহুল বছর

Mark Zuckerberg, জানুয়ারি 2025, Joe Rogan এর সাথে: "সম্ভবত 2025 সালে, আমরা Meta তে... এমন একটা AI পাব যেটা কার্যত একজন মিডলেভেল ইঞ্জিনিয়ারের মতো, যে কোড লিখতে পারে।" কয়েক সপ্তাহ পর আর্নিংস কলে তিনি 2025 এর জন্য আরও দুটো যোগ করেছিলেন: শীর্ষস্থানীয় বিলিয়ন ইউজারের অ্যাসিস্ট্যান্ট হিসেবে Meta AI, আর সবচেয়ে উন্নত ও ব্যবহৃত মডেল হিসেবে Llama।

তিনটার একটাও ঘটেনি। Llama 4 নীরবে এসেছিল, আর Gemini 3 নভেম্বর 2025 এ ফ্রন্টিয়ার মুকুট নিয়ে নিয়েছিল। আর Meta তার টাকার দিক থেকে উল্টো বাজি ধরে বছরটা কাটিয়েছে: Scale AI এর অর্ধেকের জন্য $14.3B, রিসার্চার পে প্যাকেজ $100M থেকে $450M এর মধ্যে রিপোর্ট করা হয়েছে, তারপর অক্টোবরে সুপারইন্টেলিজেন্স ল্যাব থেকে 600 জন ছাঁটাই আর 2026 এর মে তে প্রায় 8,000 লে-অফ।

Meta একটা AI ভবিষ্যদ্বাণী করেছিল যেটা মিডলেভেল ইঞ্জিনিয়ারের মতো কোড লেখে, আর তার বদলে আঠারো মাস কাটিয়েছে মানুষ ইঞ্জিনিয়ারদের জন্য বিশ্ব রেকর্ড বাজারমূল্য তৈরি করতে। গ্রেড: F।

Elon Musk, এপ্রিল 2024: "সম্ভবত আগামী বছরের শেষ নাগাদ যেকোনো একজন মানুষের চেয়ে বুদ্ধিমান" AI।

2025 এর শেষে, xAI এর ফ্ল্যাগশিপ মডেল ছিল Grok 4, "বিশ্বের সবচেয়ে বুদ্ধিমান AI" হিসেবে চালু হয়েছিল, আর Humanity's Last Exam নামের একটা বেঞ্চমার্কে স্কোর করেছিল 25.4%। দাবিটা পরীক্ষার মুখোমুখি হয়ে টেকেনি। গ্রেড: F।

Mira Murati, জুন 2024: প্রায় আঠারো মাসে "নির্দিষ্ট কাজের জন্য" PhD লেভেলের বুদ্ধিমত্তা।

গণিতের জন্য এটা প্রায় ঘটেছে: Google DeepMind এর Deep Think 2025 International Math Olympiad এ অফিশিয়ালি সার্টিফায়েড গোল্ড জিতেছে, বেশিরভাগ 2024 এর পূর্বাভাসের চেয়ে বছর কয়েক আগে। তিনি যে যোগ্যতা ব্যবহার করেছিলেন, "নির্দিষ্ট কাজের জন্য", সেটাই আসল কাজ করছে, আর এটাই ঠিক সেই যোগ্যতা যা তার আরও জোরালো সহকর্মীরা ব্যবহার করতে অস্বীকার করেছিলেন। শর্তসাপেক্ষ ভার্সনটা সত্যি হয়েছে। শর্তহীনটা, যা 2025 এর আগস্টে GPT-5 এর "PhD-level" ব্র্যান্ডিং হিসেবে এসেছিল, এতটাই খারাপভাবে গেছে যে Altman স্বীকার করেছেন OpenAI রোলআউটটা "পুরোপুরি ঝামেলা" করে ফেলেছে। গ্রেড: B-।

সংশয়বাদীর রিপোর্ট কার্ড

Gary Marcus 2025 সালের 1 জানুয়ারি 25টা তারিখযুক্ত ভবিষ্যদ্বাণী প্রকাশ করেছিলেন। ইন্ডাস্ট্রি সাধারণত তাকে গুরুত্ব দেয় না। তার গ্রেডযোগ্য দাবিগুলো গ্রেড করা হলো:

  • "আমরা এই বছর আর্টিফিশিয়াল জেনারেল ইন্টেলিজেন্স দেখব না।" সঠিক।
  • এজেন্টরা "2025 জুড়ে অবিরাম হাইপ পাবে কিন্তু নির্ভরযোগ্য থেকে অনেক দূরে থাকবে।" সঠিক, পুরো প্রথম সেকশন দেখুন।
  • "AI মডেল থেকে লাভ সংযত বা নেই বলেই থাকবে।" রাজস্ব বিস্ফোরিত হয়েছে, কিন্তু তিনি লাভের কথা বলেছিলেন, আর ল্যাবগুলো এখনো নগদ পুড়িয়ে চলেছে। শব্দগতভাবে সঠিক।
  • সম্ভবত 2025 সালে কোনো "GPT-5 লেভেল" ঐকমত্যের লাফ নেই। GPT-5 এসেছিল; লাফটা আসেনি। আত্মায় সঠিক।

গ্রেড: A-। মাইনাসটা কেটে নেওয়া হয়েছে তালিকায় যা নেই তার জন্য: এতে $4B কোডিং টুল ক্যাটাগরি, একটা IMO গোল্ড, বা এজেন্ট সত্যিকারভাবে কাজে লাগার মতো কিছুরই ভবিষ্যদ্বাণী নেই, যেখানে আউটপুট যাচাইযোগ্য। 2025 এর সেরা পূর্বাভাসদাতা প্রতিটা ব্যর্থতা ধরেছিলেন আর প্রতিটা সাফল্য মিস করেছিলেন।

আর অস্বস্তিকর দ্বিতীয় ধাপের সত্যটা: সঠিক হয়ে তিনি প্রায় কিছুই পাননি। যে ইনভেস্টররা তার পুরো বিশ্বদৃষ্টির বিরুদ্ধে বাজি ধরেছিল, তারাই Cursor কে $60B এ মূল্যায়ন করেছে। পূর্বাভাসের নির্ভুলতা আর আর্থিক রিটার্ন আলাদা স্কোরবোর্ডে চলে, আর এদের একটাই কম্পাউন্ড হয়।

ক্যাপাবিলিটি ভবিষ্যদ্বাণী সত্যি হয়েছে। ডিপ্লয়মেন্ট ভবিষ্যদ্বাণী হয়নি

18টা ভবিষ্যদ্বাণীকে দুটো স্তূপে ভাগ করুন আর কোলাহল মিলিয়ে যাবে।

ক্যাপাবিলিটি নিয়ে ভবিষ্যদ্বাণী, মডেল কী করতে পারবে, ভালোভাবে টিকে গেছে আর কখনো কখনো আগেভাগেই সত্যি হয়েছে। METR অনুযায়ী, এজেন্ট যত দৈর্ঘ্যের কাজ শেষ করতে পারে তা প্রায় প্রতি চার থেকে সাত মাসে দ্বিগুণ হচ্ছে, আর প্রবণতা টিকে আছে।

ডিপ্লয়মেন্ট নিয়ে ভবিষ্যদ্বাণী, সংগঠনগুলো AI কে আসলে কী করতে দেবে, প্রায় সবই ব্যর্থ হয়েছে। ওয়ার্কফোর্স এজেন্ট, বিলিয়ন এজেন্ট প্ল্যাটফর্ম, বদলে যাওয়া প্রোগ্রামার, AI কর্মী: সবই মান বার, দায়বদ্ধতা, ইন্টিগ্রেশন খরচ, আর এই একগুঁয়ে সত্যের একই দেয়ালে আঘাত করেছে যে 30% কাজ শেষ করা একটা সিস্টেম একটা ডেমো, একটা নিয়োগ না।

Altman বলেছিলেন এজেন্টরা ওয়ার্কফোর্সে যোগ দেবে। তারা IDE তে যোগ দিয়েছে, কারণ IDE হলো সেই একমাত্র কর্মস্থল যেখানে একটা ভুল উত্তর একটা কম্পাইলার ধরে ফেলে, গ্রাহক না।

তাহলে এখানে আমার এখন ব্যবহার করা সিদ্ধান্তের নিয়ম, আমার নিজের টাকা বাজিতে রেখে: আপনি যখন একটা ক্যাপাবিলিটি ভবিষ্যদ্বাণী শোনেন, গুরুত্ব সহকারে নিন, এমনকি বুনো দাবিগুলোও, কারণ প্রবণতা রেখা জিততেই থাকে। আপনি যখন তারিখসহ একটা ডিপ্লয়মেন্ট ভবিষ্যদ্বাণী শোনেন, টাইমলাইন দ্বিগুণ করুন, তারপর দেখুন যে বলছে সে আসলে কী বিক্রি করছে। এই একই নিয়মে আমি কোন মডেলের জন্য টাকা দেব তা বেছে নিই: বেঞ্চমার্ক একটা ক্যাপাবিলিটি দাবি, ওয়ার্কফ্লো একটা ডিপ্লয়মেন্ট দাবি।

এখান থেকে প্রতি কোয়ার্টারে যা ডিউ হয় তা আমি গ্রেড করি, আর পরের সংখ্যা শুরু হয় আমার নিজের তারিখযুক্ত ভবিষ্যদ্বাণী দিয়ে, যাতে আপনি আমাকে একই রুব্রিক দিয়ে যাচাই করতে পারেন। গ্রেডিং ফ্রি। গ্রেড হওয়াটাই দাম।

চেকলিস্ট
  • একটা ভবিষ্যদ্বাণীকে তার নিজের কথা আর নিজের ডেডলাইন ধরে গ্রেড করুন; "একসময়" কোনো গ্রেড না
  • ক্যাপাবিলিটি ভবিষ্যদ্বাণী গুরুত্ব সহকারে নিন, এমনকি বুনো দাবিগুলোও; প্রবণতা রেখা জিততেই থাকে
  • তারিখসহ যেকোনো ডিপ্লয়মেন্ট টাইমলাইন দ্বিগুণ করুন
  • ভবিষ্যদ্বাণীদাতা আসলে কী বিক্রি করছে তা যাচাই করুন
  • নিজের ভবিষ্যদ্বাণী তারিখসহ লিখে রাখুন যাতে কেউ আপনাকে ফিরিয়ে গ্রেড করতে পারে

প্রায়ই জিজ্ঞাসিত প্রশ্ন

Dario Amodei কি সঠিক ছিলেন যে AI 90% কোড লিখবে?

নিজের ডেডলাইনে না। তিনি বলেছিলেন 2025 সালের মার্চ থেকে তিন থেকে ছয় মাসের মধ্যে 90%, আর বারো মাসের মধ্যে প্রায় সব কোড। 2026 এর শুরুতে ইন্ডাস্ট্রিজুড়ে অনুমান 25% থেকে 41% এর মধ্যে জড়ো হয়েছে, আর 2026 এর মাঝামাঝি নাগাদ Google এ নতুন কোডের 75%, যেখানে প্রতিটা গৃহীত অটোকমপ্লিট গোনা হয়েছে। দিকনির্দেশনা ঠিক ছিল, সংখ্যাগুলো ভুল ছিল।

AI এজেন্টরা কি 2025 সালে ওয়ার্কফোর্সে যোগ দিয়েছিল?

সফটওয়্যারের বাইরে না। MIT এর NANDA প্রজেক্ট দেখেছে 95% এন্টারপ্রাইজ জেনারেটিভ AI পাইলট কোনো পরিমাপযোগ্য P&L প্রভাব তৈরি করেনি, আর Carnegie Mellon এর এজেন্ট কোম্পানি টেস্টে সেরা মডেল অফিসের 30.3% কাজ শেষ করেছে। সফটওয়্যার কোম্পানির ভেতরে কোডিং এজেন্টই ছিল একমাত্র আসল ব্যতিক্রম।

AI তে 2025 সালকে সবচেয়ে সঠিকভাবে কে ভবিষ্যদ্বাণী করেছিলেন?

সংশয়বাদী Gary Marcus, এখানে গ্রেড করা দাবিগুলোতে: কোনো AGI না, এজেন্ট হাইপড কিন্তু অনির্ভরযোগ্য, লাভ এখনো সংযত, কোনো ঐকমত্যের GPT-5 লাফ না। চারটাই টিকেছে। তার তালিকা বছরের প্রতিটা সাফল্যও মিস করেছে, $4B কোডিং টুল ক্যাটাগরি থেকে IMO গোল্ড পর্যন্ত।