একই প্রম্পট, যার উত্তর ChatGPT আর Claude পাশাপাশি দেয়।
3টি প্রম্পটের একটি বেছে নিন, দুটি মডেলকে একসঙ্গে উত্তর দিতে দেখুন, আর সেই উত্তরটি রাখুন যা আপনি সত্যিই পাঠাতেন। এখানে কিছুই মডেলকে ডাকে না: উত্তরগুলো নির্দিষ্ট লেখা, তাই পাতাটি বিনামূল্যে চলে আর প্রতিবার একই থাকে।
এটি কীভাবে কাজ করে
প্রতিটি প্রম্পট ১০০-এর মধ্যে নম্বর পায়, ঠিক সেই একটি জিনিসের জন্য যা ওই প্রম্পট আসলে যাচাই করছে, আর বিজয়ী সবসময় একই মডেল নয়। কথাটা এখানেই: ChatGPT কাজ গুছিয়ে দিতে ভালো, Claude কোনটা জরুরি তা ঠিক করতে ভালো, আর আপনার কোনটা দরকার তা সামনের কাজের ওপর নির্ভর করে।
এগুলো নির্দিষ্ট নমুনা উত্তর, লেখা হয়েছে দেখানোর জন্য যে দুটি মডেল ধরনে আলাদা, মানে নয়। এগুলো মডেলের সরাসরি আউটপুট নয়, কোনো মানদণ্ড পরীক্ষাও নয়।
এই ৪০ পাতার চুক্তিটা সংক্ষেপে বলো
নির্ভুলতা ও মনোযোগের বিচারে
ChatGPT (OpenAI), 92/100
মূল শর্তগুলোর সারসংক্ষেপ:
পক্ষ: Meridian Corp (ক্লায়েন্ট) ও Halcyon Ltd (সরবরাহকারী)
মেয়াদ: ২৪ মাস, ৬০ দিন আগে বাতিল না করলে নিজে থেকেই নবায়ন
ফি: মাসে ১২,৪০০ ডলার, প্রতি বছর ৪% বৃদ্ধিসহ
দায়: সর্বোচ্চ ১২ মাসের ফি পর্যন্ত
সমাপ্তি: যেকোনো পক্ষ, ৯০ দিনের লিখিত নোটিশে
ধারা ধরে ধরে ছক লাগলে বলবেন।
Claude Sonnet (Anthropic), 96/100
এটি Meridian Corp ও Halcyon Ltd-এর মধ্যে ২৪ মাসের সেবা চুক্তি, মাসে ১২,৪০০ ডলার, যা প্রতি বছর ৪% বাড়ে।
সই করার আগে তিনটি বিষয় নজর দেওয়ার মতো: মেয়াদ শেষের ৬০ দিন আগে বাতিল না করলে চুক্তি নিজে থেকেই নবায়ন হয়, দায় এক বছরের ফিতে সীমাবদ্ধ, আর ৯০ দিনের সমাপ্তি নোটিশ স্বাভাবিকের চেয়ে লম্বা।
বাকিটা গতানুগতিক ভাষা।
রায়: Claude জিতল, 96 বনাম 92। তথ্য দুজনেই ঠিক দিয়েছে, তবে Claude সবকিছু সমান করে না সাজিয়ে বলেছে কোনটা নিয়ে দুশ্চিন্তা করা দরকার।
একটা মিটিং এড়াও, সম্পর্ক নষ্ট না করে
ভঙ্গি ও পাঠানোর মতো তৈরি কি না তার বিচারে
ChatGPT (OpenAI), 88/100
বিষয়: উত্তর: অংশীদারিত্ব নিয়ে আলোচনা
প্রিয় [নাম],
যোগাযোগ করার জন্য অসংখ্য ধন্যবাদ! দুঃখের বিষয়, বর্তমান সূচিতে এটা কোনোভাবেই মেলাতে পারছি না। আপনি আমার কথা ভেবেছেন, এর জন্য সত্যিই কৃতজ্ঞ, আর ভবিষ্যতের সুযোগের জন্য দরজাটা খোলা রাখতে চাই।
প্রকল্পটির জন্য অনেক শুভকামনা!
বিনীত, [আপনার নাম]
Claude Sonnet (Anthropic), 95/100
হ্যালো দানা,
আমন্ত্রণের জন্য ধন্যবাদ। বৃহস্পতিবারটা বাদ দিচ্ছি, সপ্তাহটা এমনিতেই বেশি ভরা, আর আধা প্রস্তুতি নিয়ে হাজির হওয়ার চেয়ে না যাওয়াই ভালো।
কাজে লাগলে ডেকটা আমি নিজেই দেখে শুক্রবারের মধ্যে মন্তব্য পাঠাতে পারি। না হলে পরের দফায় দেখা হবে।
নূরা
রায়: Claude জিতল, 95 বনাম 88। ভরাট করার ফাঁকা জায়গা নেই, সত্যিকারের কারণ আছে, আর বিকল্পও দেওয়া হয়েছে। ঠিক এভাবেই পাঠিয়ে দেওয়া যায়।
এই নোটগুলো লঞ্চের চেকলিস্টে বদলে দাও
গঠন ও দায়িত্ব বণ্টনের বিচারে
ChatGPT (OpenAI), 94/100
লঞ্চ চেকলিস্ট, সময়সীমা অনুযায়ী সাজানো:
পরিধি চূড়ান্ত করা (সোম), দায়িত্বে: প্রোডাক্ট ম্যানেজার
পেমেন্টে শেষ QA দফা (মঙ্গল), দায়িত্বে: প্রকৌশল দল
এই নোট আর শুক্রবারের মাঝে পাঁচটা কাজ দাঁড়িয়ে আছে: সোমবার পরিধি আটকে দিন যাতে QA স্থিতিশীল বিল্ড পায়, মঙ্গলবার পেমেন্টের রিগ্রেশন চালান, বুধবারের মধ্যে ডিজাইন থেকে প্রেস কিট নিন, বৃহস্পতিবার রাতে Product Hunt-এর উপকরণ সাজিয়ে রাখুন, আর শুক্রবারটা লঞ্চের জন্যই খালি রাখুন।
নোটে অঞ্চলভিত্তিক দামের কথাও আছে। ওটা আমি এই লঞ্চ থেকে বাদ দিতাম, ওটা ভার বহন করছে না।
রায়: ChatGPT জিতল, 94 বনাম 90। দায়িত্বপ্রাপ্ত লোক, সময়সীমা, আর নম্বর দেওয়া তালিকা যা সরাসরি কাজের ট্র্যাকারে বসিয়ে দেওয়া যায়।
প্রশ্ন
এটি কি সত্যিকারের মডেল ডাকে?
না। উত্তরগুলো নির্দিষ্ট লেখা, তাই পাতাটি সঙ্গে সঙ্গে খোলে আর চালাতে কিছু খরচ হয় না। নিজের প্রম্পট দুটি মডেলে একসঙ্গে পাঠাতে Whizi খুলুন।
কোন মডেল ভালো, ChatGPT না Claude?
সবদিক মিলিয়ে কোনোটিই নয়। এই তিনটি প্রম্পটে Claude চুক্তির সারসংক্ষেপ আর ইমেল জেতে, কারণ সে ঠিক করে কোনটা জরুরি; আর ChatGPT চেকলিস্ট জেতে, কারণ সে কাজ গুছিয়ে দেয়। সবকিছুর জন্য একটাই বেছে নেওয়া ঠিক সেই ভুল, যা নিয়ে এই পাতা কথা বলছে।
নির্দিষ্ট কোনো তুলনা কি শেয়ার করা যায়?
যায়। শেয়ার করার লিংক কপি করুন, যাকে পাঠাবেন তার কাছেও পাতাটি একই প্রম্পটে খুলবে।