DeepSeek বনাম ChatGPT: খরচ, মান, আর মানুষ যে অংশটা মিস করে

দ্রুত উত্তর

টেক্সট রিজনিং, গণিত, আর কোডে DeepSeek সত্যিই ChatGPT-এর প্রতিদ্বন্দ্বী, আর DeepSeek V3.2-এ একটি স্ট্যান্ডার্ড API উত্তরের খরচ প্রায় $0.0005, যেখানে GPT-5.5-এ $0.02। মাল্টিমোডাল কাজ, টুল ব্যবহার, নির্ভরযোগ্যতা, আর মডেলের চারপাশে তৈরি সবকিছুতে ChatGPT স্পষ্টভাবে এগিয়ে। পছন্দটা হলো আপনি একটি মডেল কিনছেন নাকি একটি পণ্য।

সংক্ষিপ্ত উত্তর

টেক্সট রিজনিং, গণিত, আর কোডে, DeepSeek সত্যিই ফ্রন্টিয়ার পশ্চিমা মডেলগুলোর প্রতিদ্বন্দ্বী, আর একটি API চালাতে খরচ হয় তার একটি ভগ্নাংশ মাত্র। এটা হাইপ নয়, R1 আসার সময় ইন্ডাস্ট্রি নজর দিয়েছিল কেন আর তারপর থেকে প্রতিটি প্রোভাইডারের দামের ওপর চাপ পড়েছে কেন সেটাই এর কারণ।

যা কাঁচা মডেল নয় এমন সবকিছুতে, ChatGPT এগিয়ে আছে আর ব্যবধান কম নয়। ছবি আর অডিও বোঝা, ভয়েস, আপনার ফাইলে কোড চালানো, কানেক্টর, কাস্টম অ্যাসিস্ট্যান্ট, ডেভেলপার টুলিং, লোডের নিচে নির্ভরযোগ্যতা, ডকুমেন্টেশন, ইকোসিস্টেম। আপনি যদি বানানোর জন্য একটি মডেলের বদলে একটি দৈনিক সহকারী বেছে নিচ্ছেন, তাহলে এই ব্যবধান বেঞ্চমার্ক স্কোরের চেয়ে বেশি গুরুত্বপূর্ণ। একই পণ্য-বনাম-মডেল বিভাজন Grok বনাম ChatGPT তুলনাতেও দেখা যায়।

তাই সৎ ফ্রেমিং হলো "কোনটা ভালো" নয়। এটা হলো "আপনি একটি মডেল কিনছেন নাকি একটি পণ্য?" DeepSeek খুব ভালো একটি মডেল খুব সস্তায় বিক্রি করে। OpenAI একটি পণ্য বিক্রি করে যার ভেতরে একটি খুব ভালো মডেল আছে। এগুলো ভিন্ন কেনাকাটা।

প্রথমে, আপনি কোন DeepSeek নিয়ে জিজ্ঞাসা করছেন?

প্রায় প্রতিটি বিভ্রান্তিকর DeepSeek তর্ক আসে দুজন মানুষ ভিন্ন জিনিস নিয়ে আলোচনা করা থেকে। এটি ব্যবহার করার তিনটি আলাদা উপায় আছে, আর তারা খরচ, গোপনীয়তা, আর আউটপুট দিয়ে আপনি কী করার অনুমতি পান তাতে আলাদা।

অ্যাপ আর ওয়েবসাইটDeepSeek APIওপেন ওয়েট
খরচফ্রিপ্রতি টোকেনে খুব কমআপনার নিজের কম্পিউট
আপনার ডেটা কোথায় যায়DeepSeek-এর সার্ভারDeepSeek-এর সার্ভারআপনি যেখানে চালান
সেল্ফ-হোস্ট করতে পারেন কিনানানাহ্যাঁ
ফাইন-টিউন করতে পারেন কিনানানাহ্যাঁ
বিষয় সীমাবদ্ধতাহ্যাঁ, রাজনৈতিকভাবে সংবেদনশীল বিষয়েহ্যাঁকমানো, কিন্তু প্রশিক্ষণ-স্তরের আচরণ থেকে যায়
যাদের জন্য ভালোচেষ্টা করে দেখার জন্যসস্তা প্রোডাকশন টেক্সট আর কোডগোপনীয়তা-সংবেদনশীল বা নিয়ন্ত্রিত কাজ

তৃতীয় কলামটাই মানুষ ভুলে যায়, আর সেটাই সবচেয়ে আকর্ষণীয়। DeepSeek উদার লাইসেন্সিংয়ের অধীনে মডেল ওয়েট প্রকাশ করে, যার মানে মডেলটি ডাউনলোড, নিজের হার্ডওয়্যারে চালানো, নিজের এখতিয়ারে একটি প্রোভাইডার দিয়ে হোস্ট করা, আর মানিয়ে নেওয়া সম্ভব। কোনো ফ্রন্টিয়ার পশ্চিমা ল্যাব তাদের সেরা মডেল দিয়ে এটা করে না।

ব্যবহারিক ফলাফল: যে দল একটি চীনা কোম্পানিকে ডেটা পাঠাতে পারে না তারা তবুও নিজে ওয়েট চালিয়ে বা অন্য কোথাও তা হোস্ট করা একটি প্রোভাইডারের মাধ্যমে DeepSeek ব্যবহার করতে পারে। কোনো সরকার DeepSeek নিষিদ্ধ করেছে পড়লে, তারা প্রায় সবসময় অ্যাপ আর হোস্টেড API বোঝান, ওয়েট নয়।

DeepSeek যেখানে সত্যিই প্রতিদ্বন্দ্বী

রিজনিং আর গণিত। রিজনিং লাইনটাই DeepSeek-এর সবচেয়ে শক্তিশালী কাজ। কঠিন মাল্টি-স্টেপ সমস্যা, প্রতিযোগিতার গণিত, আর লজিক পাজলে, এটি অনেক বেশি খরচে চালানো মডেলগুলোর একই মানে কাজ করে। যাচাইযোগ্য সঠিক উত্তরসহ একটি সমস্যা থাকলে, প্রথমে সেখানে টেস্ট করার মতো।

কোড। ইমপ্লিমেন্টেশন, রিফ্যাক্টরিং, ডিবাগিং, আর অপরিচিত কোড ব্যাখ্যায় শক্তিশালী। বড় মাপের কোডবেস রিজনিংয়ে সেরা নয়, যেখানে একটি খুব বড় কনটেক্সট উইন্ডো বেশি সাহায্য করে, কিন্তু প্রতি ডলারে অনেক বেশি শক্তিশালী।

দৃশ্যমান রিজনিং। রিজনিং মডেলগুলো তাদের কাজ এমনভাবে দেখায় যা পর্যালোচনার জন্য সত্যিই কাজে লাগে। উত্তর ভুল হলে, আপনি সাধারণত দেখতে পারেন কোন ধাপে ভুল হয়েছে, যা শুনতে যতটা মনে হয় তার চেয়ে বেশি মূল্যবান যখন আপনি আউটপুটে বিশ্বাস না করে যাচাই করছেন।

খরচ। এটাই মূল খবর। DeepSeek V3.2-এর তালিকাভুক্ত দাম প্রতি মিলিয়ন ইনপুট টোকেনে $0.269 আর প্রতি মিলিয়ন আউটপুটে $0.40, যেখানে GPT-5.5-এর জন্য $5 আর $30, যা প্রতি স্ট্যান্ডার্ড উত্তরে প্রায় $0.0005 বনাম $0.02 হিসেবে দাঁড়ায় (Whizi মডেল কস্ট ইনডেক্স, আগস্ট 2026)। ক্যাশিং ডিসকাউন্ট ব্যবধানকে আরও চওড়া করে। ভলিউমে চলা যেকোনো কিছুর জন্য, এটা ছোট কোনো সাশ্রয় নয়, এটাই একটি ফিচার সম্ভাব্য হওয়া আর না হওয়ার পার্থক্য।

নকশার লক্ষ্য হিসেবে দক্ষতা। DeepSeek-এর গবেষণার আকর্ষণীয় অংশটি স্থাপত্যগত: মিক্সচার-অফ-এক্সপার্টস রাউটিং, স্পার্স অ্যাটেনশন, আর প্রশিক্ষণ কৌশল যা ফ্রন্টিয়ার বাজেট ছাড়াই ফ্রন্টিয়ার ফলাফল দেয়। এই কাজ প্রকাশিত হয়েছে, আর এটি স্পষ্টভাবে প্রভাবিত করেছে বাকিরা কীভাবে দাম আর তৈরি করে তা।

ChatGPT যেখানে স্পষ্টভাবে এগিয়ে

মাল্টিমোডাল কাজ। ChatGPT-কে একটি স্ক্রিনশট, হোয়াইটবোর্ড ছবি, চার্ট, বা স্ক্যান করা ইনভয়েস দিন আর এটি ভালোভাবে সামলায়। DeepSeek-এর টেক্সট মডেল টেক্সট মডেলই। আপনার কাজে ছবি জড়িত থাকলে, এটাই একাই নির্ণায়ক।

টুল ব্যবহার আর কোড এক্সিকিউশন। ChatGPT আপনার আপলোড করা ডেটার বিপরীতে কোড চালাতে পারে, একটি চার্ট তৈরি করতে পারে, আর ফাইলটি আপনাকে দিতে পারে। সেই ওয়ার্কফ্লো, সঙ্গে কর্মস্থলের টুলে কানেক্টর, একটি পণ্যের সক্ষমতা, আর কোনো একক মডেল নিজে থেকে এটি প্রতিস্থাপন করে না।

নির্ভরযোগ্যতা আর ক্ষমতা। DeepSeek-এর হোস্ট করা সেবায় লোডের নিচে দৃশ্যমান অবনতি আর সাইনআপ বিরতির সময় গেছে। গ্রাহক নির্ভর করে এমন কিছু বানাচ্ছেন হলে, আপটাইম ইতিহাস মানের মতোই গুরুত্বপূর্ণ।

ইকোসিস্টেম। SDK, ভালোভাবে ডকুমেন্টেড ফাংশন কলিং, ইন্টিগ্রেশন, অস্পষ্ট সমস্যার কমিউনিটি উত্তর, আর টুলিং ইতিমধ্যে জানা একটি হায়ারিং পুল। রাত ২টায় একটি অদ্ভুত এজ কেসে পড়লে, কেউ এটা নিয়ে লিখেছে এমন সম্ভাবনা অনেক বেশি।

আচরণের ধারাবাহিকতা। দীর্ঘ কথোপকথনজুড়ে ChatGPT জটিল ফরম্যাটিং আর রোল নির্দেশনা আরও নির্ভরযোগ্যভাবে মেনে চলে। DeepSeek বেশি সরে যায়, যা এজেন্ট-স্টাইল ওয়ার্কলোডে দ্রুত দেখা যায় যেখানে একই প্রম্পট হাজারবার চলে।

ভয়েস, ছবি আউটপুট, আর বাকি সবকিছু। টেক্সটের বাইরে জেনারেশন মানুষ যার জন্য টাকা দেয় তার একটা বড় অংশ, আর DeepSeek-এর অফারের আসলে অংশ নয়।

খরচের তুলনা, সঠিকভাবে করা

আপনি যদি একটি চ্যাট ইন্টারফেস ব্যবহার করেন, এই অংশটা প্রায় গুরুত্বহীন: DeepSeek-এর অ্যাপ ফ্রি আর ChatGPT Plus মাসে $20। এগিয়ে যান।

আপনি যদি কিছু বানাচ্ছেন, প্রতি-টোকেনের পার্থক্যটা দ্রুত জমা হয়। একটি বাস্তবসম্মত সাপোর্ট-অ্যাসিস্ট্যান্ট ওয়ার্কলোড ধরুন: প্রতি রিকোয়েস্টে 2,000 ইনপুট টোকেন আর 500 আউটপুট টোকেন, মাসে 50,000 রিকোয়েস্ট। এটা 100 মিলিয়ন ইনপুট টোকেন আর 25 মিলিয়ন আউটপুট টোকেন। GPT-5.5-এর তালিকাভুক্ত রেটে (প্রতি মিলিয়ন ইনপুটে $5, প্রতি মিলিয়ন আউটপুটে $30) মাসে খরচ হয় $1,250। DeepSeek V3.2-এর রেটে ($0.269 আর $0.40) একই ওয়ার্কলোডে খরচ হয় প্রায় $37, 30 গুণেরও বেশি ব্যবধান। DeepSeek নিজে ইন্ডাস্ট্রিজুড়ে যে দাম কমানো শুরু করেছিল তার পরেও, সেই ব্যবধান চওড়া থেকে গেছে।

গণিতটা বদলে দেয় এমন তিনটি জিনিস, আর এগুলোই মানুষ মিস করে:

  • রিজনিং মডেল আপনি কখনো দেখেন না এমন অনেক টোকেন তৈরি করে। এক্সটেন্ডেড থিংকিং দৃশ্যমান আউটপুটের কয়েক গুণ হতে পারে। প্রতি টোকেনে সস্তা গুণন করলে অনেক বেশি টোকেনে সবসময় সস্তা হয় না। প্রতি টোকেনের দামের বদলে মোট টোকেন মাপুন।
  • স্থির সিস্টেম প্রম্পটসহ যেকোনো কিছুর জন্য, হেডলাইন দামের চেয়ে ক্যাশ দাম বেশি গুরুত্বপূর্ণ। পুনরাবৃত্ত ইনপুটে একটি বড় ডিসকাউন্ট একটি ছোট স্টিকার দামকে হারাতে পারে।
  • সবচেয়ে সস্তা মডেল যা আপনার মূল্যায়ন পাস করে সেটাই জেতে। সেরা মডেল নয়। পরিচিত ভালো আউটপুটসহ আসল ইনপুটের একটি ছোট টেস্ট সেট বানান, আর দুটির বিপরীতেই চালান। বেশিরভাগ প্রোডাকশন ওয়ার্কলোডে একটি ফ্রন্টিয়ার মডেল দরকার হয় না, আর এটা শুধু মেপে জানা যায়।

দলগুলোর জন্য একটি বুদ্ধিমান প্যাটার্ন: বেশিরভাগ ট্রাফিক সস্তা মডেলে রুট করুন, আস্থা কম হলে বা কাজটি উচ্চ-ঝুঁকির হলে দামি মডেলে বাড়ান। আপনি যদি একটি ভেন্ডরের API-তে আটকে না থাকেন তাহলে এটা বানানো অনেক সহজ।

গোপনীয়তা, এখতিয়ার, আর সেন্সরশিপ

এটা একটি ভয়ের গল্প হিসেবে নয়, বাস্তবিকভাবে সামলানোর যোগ্য, কারণ এই বিস্তারিতগুলোই ঠিক করে এটা আপনাকে আদৌ প্রভাবিত করে কিনা।

ডেটা কোথায় যায়। DeepSeek-এর হোস্ট করা সেবা চীনের সার্ভারে ডেটা প্রক্রিয়া আর সংরক্ষণ করে, আর তাদের গোপনীয়তা নীতি তাই বলে। চীনা আইন বেশিরভাগ পশ্চিমা কাঠামোর চেয়ে দেশীয়ভাবে সংরক্ষিত ডেটায় কর্তৃপক্ষকে বেশি প্রবেশাধিকার দেয়। এটা আপনাকে প্রভাবিত করে কিনা তা সম্পূর্ণভাবে নির্ভর করে আপনি কী পাঠাচ্ছেন তার ওপর। একটি রেসিপির প্রশ্ন কোনো ঝুঁকি নয়। ক্লায়েন্ট চুক্তি, রোগীর ডেটা, অপ্রকাশিত কোড, বা GDPR বা একটি গ্রাহক ডেটা প্রসেসিং চুক্তির আওতাভুক্ত যেকোনো কিছু ভিন্ন বিষয়। চ্যাটবট গোপনীয়তা তুলনা প্রতিটি প্রধান প্রোভাইডারজুড়ে এই নীতিগুলো পাশাপাশি রাখে।

নিয়ন্ত্রক প্রতিক্রিয়া। বেশ কয়েকটি সরকার আর নিয়ন্ত্রক সংস্থা তাদের সরকারি ডিভাইসে বা তাদের এখতিয়ারে DeepSeek অ্যাপ সীমাবদ্ধ করেছে, ডেটা হ্যান্ডলিংয়ের কথা বলে। আপনার প্রতিষ্ঠানের কোনো ক্রয় বা নিরাপত্তা পর্যালোচনা প্রক্রিয়া থাকলে, হোস্ট করা সেবাটি সেটা পাস না করার আশা রাখুন, আর সেই সিদ্ধান্তটি মডেল মানের চেয়ে এখতিয়ার নিয়ে হবে বলে আশা রাখুন।

কনটেন্ট সীমাবদ্ধতা। হোস্ট করা সেবাটি রাজনৈতিকভাবে সংবেদনশীল বিষয়ে, বিশেষ করে চীনের ভেতরে সংবেদনশীল বিষয়ে, প্রত্যাখ্যান করে বা এড়িয়ে যায়। ওপেন ওয়েট চালানো এটা কমায়, কারণ প্রত্যাখ্যান স্তরটি আংশিকভাবে সার্ভিং স্ট্যাকে, কিন্তু কিছু আচরণ প্রশিক্ষণে বাঁধা থাকে আর পুরোপুরি অদৃশ্য হয় না। আপনার কাজ ইতিহাস, ভূরাজনীতি, বা সরকার নিয়ে তুলনামূলক কিছু ছুঁলে, নির্ভর করার আগে এটা টেস্ট করুন।

যে সমাধানটা আসলেই কাজ করে। ওপেন ওয়েট আপনার নিজের এখতিয়ারে হোস্ট করা একটি প্রোভাইডারের মাধ্যমে ব্যবহার করুন, বা নিজেই চালান। আপনি খরচ আর মানের সুবিধা রাখেন, আর ডেটা-রেসিডেন্সি প্রশ্নটি চলে যায়। এটাই ঠিক কারণ ওপেন ওয়েট কৌশলগতভাবে গুরুত্বপূর্ণ, কখনো কখনো এটাকে যে সদিচ্ছার অঙ্গভঙ্গি হিসেবে পড়া হয় তার অনেক বাইরে।

প্রধান প্রোভাইডাররা চ্যাট ডেটা, রিটেনশন, আর প্রশিক্ষণ অপ্ট-আউট কীভাবে সামলায় তার একটি পূর্ণ তুলনার জন্য, আমাদের AI সাবস্ক্রিপশন খরচ গাইড কেনার দিকটা কভার করে আর বাকির জন্য প্রতিটি ভেন্ডরের বর্তমান নীতি পেজই কর্তৃপক্ষীয় উৎস।

কে কোনটা ব্যবহার করবেন

আপনি যদি হনব্যবহার করুনকারণ
একজন সাধারণ দৈনিক ব্যবহারকারীChatGPTমডেলের চারপাশের পণ্যটাই বেশিরভাগ মূল্য
খরচ-সংবেদনশীল আর ভলিউমে বানাচ্ছেনDeepSeek APIটেক্সট আর কোডে তালিকাভুক্ত রেটে 30 গুণেরও বেশি সস্তা
একটি নিয়ন্ত্রিত ইন্ডাস্ট্রিতেDeepSeek ওপেন ওয়েট, সেল্ফ-হোস্টেড, বা একটি পশ্চিমা মডেলডেটা রেসিডেন্সিই পুরো প্রশ্ন
ভারী গণিত বা লজিক করছেনদুটোই টেস্ট করুনDeepSeek এখানে সত্যিই শক্তিশালী আর চেষ্টা করা সস্তা
ছবি, অডিও, বা ফাইল নিয়ে কাজ করছেনChatGPTDeepSeek-এর টেক্সট মডেল এটা কভার করে না
প্রোডাকশনে একটি এজেন্ট লুপ চালাচ্ছেনChatGPT, তারপর অপ্টিমাইজ করুননির্দেশনা-অনুসরণের ধারাবাহিকতা প্রথমে দামকে হারায়
গবেষণা বা পরীক্ষা-নিরীক্ষা করছেনদুটোইDeepSeek চেষ্টা করার খরচ প্রায় শূন্য

বেশিরভাগ দল যে প্যাটার্নে থিতু হয় তা একটি বা অন্যটি নয়। এটা হলো ভলিউম কাজের জন্য একটি সস্তা সক্ষম মডেল, কঠিন কেস আর গ্রাহক-মুখী যেকোনো কিছুর জন্য একটি ফ্রন্টিয়ার মডেল, আর তাদের মধ্যে একটি রাউটিং নিয়ম। এটা একটি বুদ্ধিমান স্থাপত্য, আর এই কারণেই ভেন্ডরটা পছন্দ হলেও একক-ভেন্ডর লক-ইন এড়ানো মূল্যবান।

চারটি অ্যাকাউন্ট না খুলে আর হোস্ট করা কোনো চীনা এন্ডপয়েন্টে কিছু না পাঠিয়ে DeepSeek-এর রিজনিং GPT, Claude, আর Gemini-এর বিপরীতে চেষ্টা করতে চাইলে, Whizi এগুলো সবাইকে একটি সাবস্ক্রিপশনে অন্তর্ভুক্ত করে, আর খরচের ব্যবধানও থাকে: একটি DeepSeek V3.2 বার্তা 1 ক্রেডিট খরচ করে, যেখানে GPT-5.5-এর জন্য 20। একই প্রম্পট দুটি মডেলে দিন, ভালো উত্তরটি রাখুন, আর এটা বাস্তবে কীভাবে কাজ করে তার জন্য দেখুন মডেল পাশাপাশি তুলনা করা

চেকলিস্ট
  • আপনি অ্যাপ, API, নাকি ওপেন ওয়েট বোঝাচ্ছেন তা ঠিক করুন, কারণ এগুলো প্রতিটি দিকে আলাদা
  • হোস্ট করা সেবা ব্যবহারের আগে আপনার ডেটা আইনগতভাবে আপনার এখতিয়ার ছেড়ে যেতে পারে কিনা যাচাই করুন
  • শুধু প্রতি-টোকেন দামের বদলে লুকানো রিজনিংসহ মোট টোকেন মাপুন
  • পরিচিত ভালো উত্তরসহ আসল ইনপুটের একটি ছোট সেটের বিপরীতে দুটোই টেস্ট করুন
  • আপনার কাজে ছবি, অডিও, বা ভয়েস জড়িত থাকলে সঙ্গে সঙ্গে DeepSeek বাদ দিন
  • একটি বেছে নেওয়ার বদলে সস্তা ট্রাফিক এক মডেলে আর কঠিন কেস আরেকটিতে রাউট করা বিবেচনা করুন

প্রায়ই জিজ্ঞাসিত প্রশ্ন

DeepSeek কি ChatGPT-এর চেয়ে ভালো?

টেক্সট রিজনিং, গণিত, আর কোডে, DeepSeek প্রতি স্ট্যান্ডার্ড API উত্তরে প্রায় $0.0005-এ প্রতিদ্বন্দ্বী, যেখানে তালিকাভুক্ত রেটে GPT-5.5-এর জন্য $0.02। মাল্টিমোডাল কাজ, টুল ব্যবহার, নির্ভরযোগ্যতা, আর মডেলের চারপাশে তৈরি সবকিছুতে ChatGPT স্পষ্টভাবে এগিয়ে। কোনটা জিতবে তা নির্ভর করে আপনি একটি মডেল কিনছেন নাকি একটি পণ্য তার ওপর।

DeepSeek ব্যবহার করা কি নিরাপদ?

হোস্ট করা অ্যাপ আর API চীনের সার্ভারে ডেটা প্রক্রিয়া করে, যা বেশ কয়েকটি সরকার সরকারি ব্যবহারের জন্য সীমাবদ্ধ করেছে। ব্যক্তিগত, অ-সংবেদনশীল প্রশ্নের জন্য এটা একটি ছোট উদ্বেগ। ক্লায়েন্ট ডেটা, নিয়ন্ত্রিত ডেটা, বা মালিকানাধীন কোডের জন্য এটা একটি আসল উদ্বেগ, আর সমাধান হলো নিজে বা আপনার এখতিয়ারে একটি প্রোভাইডারের মাধ্যমে ওপেন ওয়েট চালানো।

DeepSeek কি সত্যিই ওপেন সোর্স?

মডেল ওয়েট উদার লাইসেন্সিংয়ের অধীনে প্রকাশিত, তাই আপনি সেগুলো ডাউনলোড, চালানো, হোস্ট আর মানিয়ে নিতে পারেন। প্রশিক্ষণ ডেটা আর পূর্ণ প্রশিক্ষণ পাইপলাইন প্রকাশিত নয়, তাই কঠোর অর্থে ওপেন সোর্সের চেয়ে "ওপেন ওয়েট" শব্দটাই সঠিক। এটা তবুও যেকোনো ফ্রন্টিয়ার পশ্চিমা মডেলের চেয়ে অনেক বেশি খোলা।

DeepSeek কেন এত সস্তা?

মূলত স্থাপত্যগত দক্ষতা। মিক্সচার-অফ-এক্সপার্টস রাউটিং প্রতি টোকেনে মডেলের শুধু একটা অংশ সক্রিয় করে, আর পরবর্তী রিলিজগুলো স্পার্স অ্যাটেনশন যোগ করেছে যা দীর্ঘ ইনপুটের খরচ কমায়। ল্যাবটি এই গবেষণা প্রকাশ করেছে, আর তার ফলে দামের চাপ পুরো ইন্ডাস্ট্রিকে নিচে ঠেলে দিয়েছে।

আমি কি চীনে ডেটা না পাঠিয়ে DeepSeek ব্যবহার করতে পারি?

হ্যাঁ। ওয়েট প্রকাশিত বলে, আপনি মডেলটি নিজের হার্ডওয়্যারে চালাতে পারেন বা আপনার অঞ্চলে হোস্ট করা একটি প্রোভাইডার ব্যবহার করতে পারেন। আপনি খরচ আর মানের সুবিধা রাখেন আর ডেটা-রেসিডেন্সি সমস্যাটি চলে যায়।