সংক্ষিপ্ত উত্তর
PDF-টা মেসেজ বক্সে টেনে আনুন বা এটা যুক্ত করতে পেপারক্লিপ আইকনে ক্লিক করুন, তারপর সহজ ভাষায় আপনার প্রশ্ন জিজ্ঞাসা করুন। আপনার প্ল্যানের যেকোনো মডেল এটা পড়তে পারে, আর একই ফাইলের বিপরীতে আবার আপলোড না করেই আপনি মডেল বদলাতে পারেন।
কোনো উত্তরের ওপর ভরসা করার আগে একটা কাজ করুন: মডেলকে বলুন সে যে অংশটুকু ব্যবহার করেছে তা উদ্ধৃত করতে। ট্রেনিং ডেটা থেকে আসা একটা আত্মবিশ্বাসী উত্তর, আপনার ফাইলের বদলে, এমন ব্যর্থতা যেটা মানুষের টাকা খরচ করায়, আর একটা লোকেটিং প্রশ্ন প্রায় দশ সেকেন্ডে এটা ধরে ফেলে। এই পাতার বাকি অংশ হলো এটা ভালোভাবে করার পদ্ধতি।
প্রথমে, নিশ্চিত করুন এটা আপনার নথি পড়ছে
নথি চ্যাটে সবচেয়ে বিপজ্জনক ব্যর্থতা একটা ভুল উত্তর নয়, এটা হলো আপনার ফাইলের বদলে ট্রেনিং ডেটা থেকে আসা একটা আত্মবিশ্বাসী উত্তর। এটা সবচেয়ে বেশি ঘটে এমন নথির সাথে যা সাধারণ কিছুর মতো দেখতে: একটা প্রমিত বাণিজ্যিক লিজ, একটা সুপরিচিত নিয়মকানুন, একটা ব্যাপকভাবে আলোচিত গবেষণাপত্র। মডেলটা এই ধরনটা এতটাই ভালো জানে যে আপনার নির্দিষ্ট টেক্সট না দেখেই একটা বিশ্বাসযোগ্য উত্তর তৈরি করতে পারে, আর আউটপুটে এমন কিছু নেই যা বলে দেয় যে এটা তাই করেছে।
একটা অভ্যাস এটা দূর করে। আপনার আসল প্রশ্ন জিজ্ঞাসা করার আগে, একটা লোকেটিং প্রশ্ন জিজ্ঞাসা করুন।
সংযুক্ত নথিতে [বিষয়] নিয়ে আলোচনা করা অংশটুকু উদ্ধৃত করুন, আর এটা কোন পাতা বা সেকশনে আছে তা বলুন। এটা যদি নথিতে না থাকে, তাহলে তা বলুন।
যদি এটা একটা আসল উদ্ধৃতি ফেরত দেয়, তাহলে এটা আপনার ফাইল পড়ছে। যদি এটা একটা সাধারণ প্যারাফ্রেজ তৈরি করে বা আপনি জানেন এমন কিছু খুঁজে না পায়, তাহলে এক্সট্রাকশন ব্যর্থ হয়েছে আর এরপরের প্রতিটা উত্তর সন্দেহজনক। এতে দশ সেকেন্ড লাগে আর এটাই একটা টুল আর একটা দায়ের মধ্যে পার্থক্য।
এই অভ্যাসটা আসল প্রশ্নগুলোতেও বহন করুন: আপনার উত্তরকে সমর্থন করে এমন সঠিক টেক্সট উদ্ধৃত করুন এমন যেকোনো প্রম্পটে থাকা উচিত যার উত্তরের ওপর ভরসা করা হবে।
নথির জন্য একটা মডেল বাছাই করা
| নথি | মডেল | কেন |
|---|---|---|
| 100+ পাতার রিপোর্ট, ফাইলিং, সম্পূর্ণ চুক্তির সেট | Gemini | একটা 1,000,000 টোকেন কনটেক্সট উইন্ডো, তাই নথিটা টুকরো টুকরো করার বদলে সত্যিই উপস্থিত থাকে |
| চুক্তি, নীতিমালা, যেখানে যোগ্যতা গুরুত্বপূর্ণ | Claude | সূক্ষ্মতায় আর একটা নথি কী বলছে না তা বলায় সেরা |
| চালান, ফর্ম, ছোট কাঠামোবদ্ধ ফাইল | GPT | দ্রুত, আর টেবিল বা JSON-এ কঠোর এক্সট্রাকশনে সবচেয়ে নির্ভরযোগ্য |
| চিত্রসহ গবেষণাপত্র, স্ক্যান করা পাতা, ডায়াগ্রাম | যেকোনো মাল্টিমডাল মডেল | টেক্সট এক্সট্রাকশন কাজ না করলে পাতাটা একটা ছবি হিসেবে পড়ে |
কনটেক্সট উইন্ডো বিষয়টা ব্যাখ্যা করার মতো। যখন একটা নথি একটা মডেল যা ধরে রাখতে পারে তা ছাড়িয়ে যায়, তখন এটা টুকরো টুকরো করে প্রসেস করতে হয়, আর এমন প্রশ্ন যেগুলোর জন্য পুরো নথিটা একসাথে দরকার (এখানে কি ধারা 14-এর সাথে কিছু বিরোধ করে, এই শব্দটা কোথাও সংজ্ঞায়িত করা আছে কি, এই তিনটা সেকশনের মধ্যে কোনটা অসামঞ্জস্যপূর্ণ) অনির্ভরযোগ্য হয়ে যায়। এটাই নির্দিষ্ট কারণ যে জন্য দীর্ঘ ফাইলে একটা সাধারণ পছন্দের বদলে বড়-কনটেক্সট মডেলের দিকে যেতে হয়।
আপনি আবার আপলোড না করেই মডেল বদলাতে পারেন, তাই একটা দিয়ে পড়ুন আর একই ফাইলের বিপরীতে অন্যটা দিয়ে এক্সট্রাক্ট করুন। দেখুন কথোপকথনের মাঝখানে মডেল বদলানো।
নথির ধরন অনুযায়ী প্রম্পট
চুক্তি আর সমঝোতা
সংযুক্ত চুক্তি থেকে, একটা টেবিলে বের করুন: মেয়াদ আর নবায়ন, সমাপ্তির নোটিশ পিরিয়ড, পেমেন্ট শর্ত, দায়বদ্ধতার সীমা, ক্ষতিপূরণ, নিয়ন্ত্রক আইন, বরাদ্দ, আর সমাপ্তির পরেও টিকে থাকা যেকোনো ধারা। প্রতিটার জন্য, ধারা নম্বর দিন আর কার্যকরী বাক্যটা উদ্ধৃত করুন। তারপর আলাদাভাবে সেই দায়িত্বগুলো তালিকাভুক্ত করুন যা তাদের বদলে আমাদের ওপর পড়ে।
আসলে যেটা গুরুত্বপূর্ণ সেই প্রশ্ন দিয়ে ফলো আপ করুন: এই ধরনের চুক্তির জন্য প্রমিত শর্তের তুলনায় এই সমঝোতায় কী অস্বাভাবিক, আর কী স্পষ্টভাবে অনুপস্থিত? ঝুঁকি সাধারণত অনুপস্থিতিতেই থাকে, আর এটা এমন কিছু যা একটা কীওয়ার্ড সার্চ কখনো খুঁজে পাবে না।
গবেষণাপত্র
সংযুক্ত পত্র থেকে, ফেরত দিন: গবেষণা প্রশ্ন, গবেষণা ডিজাইন, নমুনা আর জনগোষ্ঠী, প্রাথমিক ফলাফল, এর প্রভাবের আকারসহ প্রধান ফলাফল, উল্লেখিত সীমাবদ্ধতা, আর অর্থায়নের উৎস। তারপর আমাকে বলুন এই পত্রের তিনটা দাবি যেগুলো উদ্ধৃত করার আগে স্বতন্ত্র যাচাই দরকার হবে।
দীর্ঘ রিপোর্ট আর ফাইলিং
সংযুক্ত রিপোর্টটা নথির ক্রম অনুযায়ী নয়, গুরুত্ব অনুযায়ী সাজানো 10টা বুলেটে সারাংশ করুন। তারপর তালিকাভুক্ত করুন: একজন সিদ্ধান্ত গ্রহণকারী গুরুত্ব দেবেন এমন তিনটা সংখ্যা তাদের পাতা রেফারেন্সসহ, রিপোর্টে উৎস ছাড়া তথ্য হিসেবে উপস্থাপিত যেকোনো কিছু, আর সারাংশ বা নির্বাহী সেকশন পরে নথির বিস্তারিত অংশের সাথে যেখানে দ্বিমত করে এমন যেকোনো জায়গা।
সেই শেষ চেকটা আশ্চর্যজনকভাবে প্রায়ই আসল সমস্যা খুঁজে পায়। নির্বাহী সারাংশ আগেভাগে লেখা হয় আর যেসব সেকশনের সারাংশ করে সেগুলোর চেয়ে কম সম্পাদনা করা হয়।
দুটো নথি তুলনা করা
contract-a.pdf আর contract-b.pdf ধারা ধরে ধারা তুলনা করুন। প্রতিটা গুরুত্বপূর্ণ পার্থক্যের একটা টেবিল ফেরত দিন: বিষয়, A কী বলে, B কী বলে, আর কোনটা আমাদের পক্ষে যায়। ফরম্যাটিং আর নম্বরিংয়ের পার্থক্য উপেক্ষা করুন। একটাতে আছে কিন্তু অন্যটাতে নেই এমন যেকোনো কিছু আলাদাভাবে তালিকাভুক্ত করুন।
এটাকে ব্যবহারযোগ্য কিছুতে রূপান্তর করা
একজন নির্বাহী দর্শকের জন্য ফলাফলগুলো 150 শব্দে নতুন করে লিখুন। প্রয়োজনীয় সিদ্ধান্ত দিয়ে শুরু করুন। সংজ্ঞায়িত নয় এমন কোনো পরিভাষা নয়। এটা ছড়ানোর আগে আমার যাচাই করা উচিত এমন যেকোনো কিছু চিহ্নিত করুন।
সমস্যা সমাধান
"আমি কোনো নথি দেখতে পাচ্ছি না।" ফাইলটা আপলোড শেষ হয়েছে কিনা নিশ্চিত করুন, তারপর আপনার মেসেজে এটাকে নাম ধরে স্পষ্টভাবে উল্লেখ করুন। খুব দীর্ঘ থ্রেডে, শুধু ফাইলটা দিয়ে আবার সংযুক্ত করা বা একটা নতুন চ্যাট শুরু করা এটা নিয়ে তর্ক করার চেয়ে দ্রুত।
স্ক্যান করা PDF, অস্পষ্ট বা অনুপস্থিত টেক্সট। নথিটা একটা ছবি, তাই সাধারণ টেক্সট এক্সট্রাকশনে পড়ার মতো বেশি কিছু নেই। Whizi একটা ছবি-ঘন PDF শনাক্ত করে এর পাতাগুলো কতটা কম টেক্সট দেয় তা দেখে, আর এটাকে একবার একটা সার্ভার-সাইড ভিশন পাসের মধ্য দিয়ে পাঠায় যা প্রতি পাতার একটা ট্রান্সক্রিপ্ট ফেরত দেয়। কম রেজোলিউশন, অস্বাভাবিক ফন্ট, হাতের লেখা, আর ঘন টেবিলে নির্ভুলতা কমে যায়। যেহেতু একটা ভুল পড়া সংখ্যা একটা সাবলীল উত্তরে অদৃশ্য থাকে, তাই একটা স্ক্যান করা নথি থেকে প্রতিটা সংখ্যা মূল পাতার বিপরীতে যাচাই করুন।
টেবিল ভুল আসে। PDF টেবিলগুলো এর নিচে কুখ্যাতভাবে খারাপভাবে গঠিত। প্রথমে টেবিলটা হুবহু পুনরুৎপাদন করতে বলুন, পাতার বিপরীতে এটা চেক করুন, আর তারপরই বিশ্লেষণের জন্য জিজ্ঞাসা করুন। ভারী টেবিল কাজের জন্য, পাতাটাকে একটা ছবি হিসেবে পড়া একটা মাল্টিমডাল মডেল প্রায়ই টেক্সট এক্সট্রাকশনের চেয়ে বেশি নির্ভরযোগ্য।
এটা এমন কিছু মিস করেছে যা আপনি জানেন সেখানে আছে। লোকেটিং প্রশ্নটা জিজ্ঞাসা করুন। যদি মডেলটা আপনি দেখতে পাচ্ছেন এমন একটা অংশ উদ্ধৃত করতে না পারে, তাহলে সমস্যাটা যুক্তির বদলে এক্সট্রাকশনে। অন্য একটা মডেল চেষ্টা করুন, বা শুধু প্রাসঙ্গিক পাতাগুলো আপলোড করুন।
ফাইলটা খুব বড়। বড়-কনটেক্সট মডেল ব্যবহার করুন, বা পাতার সংখ্যার বদলে উদ্দেশ্য অনুযায়ী ভাগ করুন। আপনার আসলে দরকার এমন তিনটা সেকশন আপলোড করা 400 পাতা আপলোড করে আশা করার চেয়ে ভালো।
কথোপকথন যত এগোয়, উত্তর তত অস্পষ্ট হয়। দীর্ঘ থ্রেডে এমন কনটেক্সট জমে যা নথির সাথে প্রতিযোগিতা করে। ফাইলটা আর আপনার যা দরকার তার একটা সংক্ষিপ্ত বিবৃতি দিয়ে একটা নতুন চ্যাট শুরু করুন।
ভরসা করার আগে যাচাই করুন
গুরুত্বের ক্রমে তিনটা চেক।
যেকোনো গুরুত্বপূর্ণ বিষয়ে উদ্ধৃতি দাবি করুন। একটা উদ্ধৃত অংশ সেকেন্ডেই যাচাইযোগ্য; একটা প্যারাফ্রেজ নয়। এই একটা অভ্যাসই নথির কাজে বেশিরভাগ ঝুঁকি দূর করে।
দ্বিতীয় একটা মডেলের সাথে ক্রস-চেক করুন। একই ফাইলের বিপরীতে একটা ভিন্ন মডেলকে একই প্রশ্ন জিজ্ঞাসা করুন। একমত হওয়া অর্থপূর্ণ প্রমাণ; দ্বিমত আপনাকে ঠিক কোথায় দেখতে হবে তা বলে দেয়। Whizi-র পাশাপাশি তুলনা এর জন্যই আছে।
এটা কী নিয়ে অনিশ্চিত তা জিজ্ঞাসা করুন। উপরের আপনার উত্তরগুলোর মধ্যে কোনটাতে আপনি সবচেয়ে কম আত্মবিশ্বাসী, আর নথিতে কী অস্পষ্ট? মডেলগুলো স্ব-মূল্যায়নে অসম্পূর্ণ, কিন্তু তারা যে অস্পষ্টতাগুলো সামনে আনে সেগুলো সাধারণত উৎসের আসল অস্পষ্টতা, যা নথিটা নিজে সম্পর্কে দরকারি তথ্য।
আর যেকোনো কিছুর জন্য স্থায়ী নিয়ম যা পরিণতি বহন করে, অর্থাৎ আইনি, আর্থিক, চিকিৎসা, বা কমপ্লায়েন্স উপাদান: মডেল অংশটা খুঁজে বের করে, বিচার আপনি করেন। এটা একটা পাঠ সহায়ক, একজন পরামর্শদাতা নয়, আর এর আউটপুটের ওপর ভিত্তি করে নেওয়া সিদ্ধান্তের জবাবদিহিতা সম্পূর্ণভাবে আপনার।
- আপনার মডেল ফাইলটা পড়ছে কিনা নিশ্চিত করতে প্রথমে একটা লোকেটিং প্রশ্ন জিজ্ঞাসা করুন
- প্রতিটা গুরুত্বপূর্ণ উত্তরের জন্য একটা সঠিক উদ্ধৃতি দাবি করুন
- দীর্ঘ নথির জন্য বড়-কনটেক্সট মডেল ব্যবহার করুন যাতে কিছুই টুকরো টুকরো করে বাদ না যায়
- নথি কী বলে তার পাশাপাশি স্পষ্টভাবে কী অনুপস্থিত তাও জিজ্ঞাসা করুন
- স্ক্যান করা নথি থেকে সংখ্যাগুলো মূল পাতার বিপরীতে যাচাই করুন
- টেবিল হুবহু পুনরুৎপাদন করুন আর বিশ্লেষণের আগে সেগুলো চেক করুন
- গুরুত্বপূর্ণ যেকোনো কিছু দ্বিতীয় একটা মডেলের বিপরীতে ক্রস-চেক করুন
প্রায়ই জিজ্ঞাসিত প্রশ্ন
সর্বোচ্চ PDF সাইজ কত?
প্রতিটা আপলোড করা ফাইল 10 MB-তে সীমাবদ্ধ, আর একটা মেসেজে সর্বোচ্চ 6টা ফাইল বহন করা যায়। এর মধ্যে, আসল সীমাবদ্ধতা হলো ফাইল ক্যাপের বদলে মডেল কনটেক্সট উইন্ডো। Whizi-তে Gemini একটা 1,000,000 টোকেন কনটেক্সট উইন্ডো বহন করে, যে কারণে এটা দীর্ঘ রিপোর্ট, ফাইলিং, আর একাধিক-চুক্তির সেটের জন্য সুপারিশ। এর ওপরে, পুরো নথির বদলে আপনার আসলে দরকার এমন সেকশনগুলো আপলোড করুন, যেহেতু লক্ষ্যভিত্তিক কনটেক্সট সাধারণত একটা তীক্ষ্ণ উত্তরও তৈরি করে।
Whizi কি আমার PDF সংরক্ষণ করে?
আপলোড করা ফাইল আপনার অ্যাকাউন্টের অধীনে সংরক্ষিত হয়, সর্বোচ্চ 30 দিন পর মেয়াদ শেষ হওয়ার জন্য কনফিগার করা থাকে, আর যেকোনো সময় আগেভাগে মুছে ফেলা যায়। Whizi-নিজস্ব AI মডেল প্রশিক্ষণের জন্য Whizi আপনার প্রম্পট, ফাইল, কথোপকথন, ভয়েস ট্রান্সক্রিপ্ট, বা তৈরি করা কনটেন্ট ব্যবহার করে না, আর সেই কনটেন্ট প্রশিক্ষণ ডেটা হিসেবে বিক্রিও করে না। একটা ফাইল মুছে ফেলা কথোপকথনে এটা নিয়ে ইতিমধ্যে যা আলোচনা হয়েছে তা সরায় না, তাই নথিটা মুছে ফেলার মতো যথেষ্ট সংবেদনশীল হলে, চ্যাটটাও মুছে ফেলুন।
আমি কি একসাথে একাধিক PDF-এর সাথে চ্যাট করতে পারি?
হ্যাঁ, আর নথির মধ্যে তুলনা করাই এটা সবচেয়ে বেশি মূল্যবান জায়গা। একই থ্রেডে একাধিক ফাইল আপলোড করুন আর আপনার প্রম্পটে সেগুলোকে নাম ধরে উল্লেখ করুন, নইলে মডেলটা আপনাকে না জানিয়েই কোনটা থেকে উত্তর দেবে তা বেছে নেয়। ধারা ধরে ধারা চুক্তি তুলনা, রিপোর্ট জুড়ে ফলাফল একত্রিত করা, আর নথির মধ্যে বিরোধ খুঁজে বের করা, এসব সবকিছু একসাথে উপস্থিত থাকা দরকার, যা বড়-কনটেক্সট মডেল ব্যবহারের আরেকটা কারণ।
এটা কি স্ক্যান করা PDF-এর সাথে কাজ করে?
হ্যাঁ। Whizi একটা স্ক্যান করা বা ছবি-ঘন PDF শনাক্ত করে এর পাতাগুলো কতটা কম টেক্সট দেয় তা দেখে, আর এটাকে একটা সার্ভার-সাইড ভিশন পাসের মধ্য দিয়ে পাতায় পাতায় ট্রান্সক্রাইব করে। পরিষ্কার স্ক্যানে নির্ভুলতা ভালো থাকে আর কম রেজোলিউশন, অস্বাভাবিক ফন্ট, হাতের লেখা, আর ঘন টেবিলের সাথে খারাপ হয়। যেহেতু একটা ভুল পড়া অক্ষর একটা অন্যথায় সাবলীল উত্তরের মধ্যে একটা ভুল সংখ্যা তৈরি করে, তাই একটা স্ক্যান করা নথি থেকে নেওয়া যেকোনো সংখ্যা মূল পাতার বিপরীতে চেক করুন।
আমি কীভাবে জানব উত্তরটা সত্যিই আমার নথি থেকে এসেছে?
একটা উদ্ধৃতি দাবি করুন। মডেলকে বলুন এর উত্তরকে সমর্থন করা সঠিক অংশটুকু পাতা বা সেকশনসহ উদ্ধৃত করতে, আর তথ্যটা নথিতে না থাকলে স্পষ্টভাবে তা বলতে। নথি চ্যাটে সবচেয়ে বিপজ্জনক ব্যর্থতা হলো ফাইলের বদলে ট্রেনিং ডেটা থেকে আসা উত্তর, ঠিক এই কারণে যে সেগুলো সাধারণ নথির ধরনের জন্য বিশ্বাসযোগ্য মনে হয়, আর একটা যাচাইযোগ্য উদ্ধৃতি দাবি করাই পার্থক্য বলার একমাত্র নির্ভরযোগ্য উপায়।