به سقف مصرف خوردید و به یک مدل جایگزین منتقل شدید
این را تصور نکردهاید. وقتی سهمیهتان را روی مدل قوی تمام میکنید، ChatGPT معمولاً شما را مسدود نمیکند و از پاسخدادن امتناع نمیکند. گفتگو را به یک مدل کوچکتر و ارزانتر میسپارد و در همان رشتهٔ گفتگو، با همان انیمیشن تایپ، ادامه میدهد. هیچچیز در پاسخ اعلام نمیکند که ماشین پشت آن عوض شده. شما فقط بهخاطر اینکه پاسخها کوتاهتر، تختتر، فراموشکارتر و با اطمینان بیشتری اشتباه شدند، متوجه میشوید.
OpenAI این را رفتاری عمدی مستند کرده. یادداشتهای انتشار مدلش، مدلی mini را توصیف میکند که کاربران پس از برخورد به محدودیت نرخ روی مدل اصلی به آن میرسند، و میگوید چون این مدل نقش جایگزین را بازی میکند، در فهرست کشویی مدلها نمایش داده نمیشود. همین یک انتخاب طراحی، بیشتر سردرگمی را توضیح میدهد: نمیتوانید مدل جایگزین را انتخاب کنید، پس هرگز به فکرتان نمیرسد بررسی کنید که روی آن هستید یا نه.
پس تشخیص صادقانه این است: مدل احتمالاً واقعاً بدتر شده، و هیچکس کاری با مدلی که انتخاب کردید نکرده. شما را از آن جابهجا کردهاند. بقیهٔ این مطلب دربارهٔ این است که چطور این را در سی ثانیه تأیید کنید و چطور دیگر از آن غافلگیر نشوید.
اول بررسی کنید که این واقعاً مشکل شماست و نه یکی از دو شبیهاش. اگر با پیامی که پلن یا محدودیتتان را نام میبرد کاملاً متوقف شدید، آن یک سقف قابلدیدن است، و ChatGPT میگوید به محدودیتم رسیدهام آن را پوشش میدهد. اگر پاسخها در همهٔ گفتگوها با خطاهای عمومی شکست میخورند، آن یک قطعی است، و چه چیزی وقتی ChatGPT از کار افتاده استفاده کنیم خواندنی سریعتر است. این مقاله برای حالت سوم است، همانی که هیچ پیام خطایی ندارد: همهچیز همچنان کار میکند، فقط بدتر است.
وقتی به سقف میخورید واقعاً چه اتفاقی میافتد
هر پلن مصرفی هوش مصنوعی بهنوعی مصرف را میسنجد، چون اجرای یک مدل بزرگ بهازای هر پیام پول واقعی هزینه دارد. چیزی که فرق میکند این است که در مرز چه اتفاقی میافتد، و اینکه کدامیک از این سه حالت نصیبتان میشود، تعیین میکند چقدر سردرگم میشوید.
| رفتار در محدودیت | چه میبینید | چقدر گیجکننده است |
|---|---|---|
| توقف سخت | بنری میگوید تا زمانی مشخص خارجید، و چیزی ارسال نمیشود | آزاردهنده، اما صادقانه. دقیقاً میدانید کجا ایستادهاید |
| تنزل قابلدیدن | اعلانی میگوید به مدلی کوچکتر منتقل شدهاید | کمی آزاردهنده، همچنان صادقانه |
| جایگزینی ساکت | گفتگو فقط ادامه مییابد، پاسخدادهشده توسط مدلی دیگر | همانی که مردم را وامیدارد فکر کنند محصول خراب شده |
ChatGPT بیشتر در ردیف سوم مینشیند. اغلب در لحظهٔ تعویض یک اعلان هست، اما اعلانها اسکرول میشوند و کنار پاسخهای بعدی نمیمانند. عمیق در یک رشتهٔ طولانی، درحالیکه پاسخها را میخوانید نه رابط دور آنها را، متوجهش نمیشوید. بعدها مدل بیسروصدا وقتی پنجرهتان از نو تنظیم شود به حالت عادی برمیگردد، به همین دلیل مردم نتیجه میگیرند کیفیت تصادفی است، نه سنجیدهشده.
یک نکته دربارهٔ اعداد، چون اینجا همان جایی است که بیشتر مقالات این موضوع اشتباه میکنند. ارائهدهندهها سقفها را پیوسته و بدون اعلام عوض میکنند، و سقفها بر اساس پلن، مدل، ویژگی و گاهی بار فعلی سرور فرق دارند، پس هر رقمی که در یک مقاله چاپ شود، عمر کوتاهی دارد. همین رقم در دو ماه دو بار عوض شد. OpenAI برای سالها روی یک پنجرهٔ متحرک چند ساعته مصرف را میسنجید، Engadget گزارش داد که پلن رایگان بهنظر میرسید حدود ژوئیه 2026 آن پنجره را برای یک سهمیهٔ هفتگی یگانه کنار گذاشته، و اوایل اوت 2026 OpenAI اعلام کرد چت متن ساده در همهٔ ردهها نامحدود میشود درحالیکه محدودیتهای جداگانه روی فایل، تصویر، صدا و تولید تصویر باقی میماند. این را هشداری دربارهٔ اعداد چاپشده بخوانید، نه وضعیت فعلی، همین مقاله را هم شامل میشود. صفحهٔ محدودیتهای خودِ ارائهدهندهتان را از داخل حسابتان بررسی کنید، نه اینکه به خلاصهٔ یک شخص ثالث اعتماد کنید. ChatGPT میگوید به محدودیتم رسیدهام پرسش بازنشانی را بهطور کامل مرور میکند.
چطور بفهمید همین حالا کدام مدل به شما پاسخ میدهد
به حستان اعتماد نکنید، بررسی کنید. رابطها هر چند ماه یکبار بازطراحی میشوند، پس بهجای توصیف اینکه امروز یک دکمه کجا نشسته، اینها چیزهایی است که باید دنبالشان بگردید. اینها به ویژگیها وابستهاند، نه پیکسلها، پس از بازطراحیها جان سالم بهدر میبرند.
- نام مدل در بالای گفتگو. هر اپ چتی مدل انتخابشده را در سربرگ یا کنار جعبهٔ نوشتن نشان میدهد. این نشان میدهد چه چیزی انتخاب شده، که همیشه همان چیزی نیست که پاسخ داده.
- کنترلهای زیر یک پاسخ خاص. روی یک پاسخ مشخص هاور کنید یا فشار طولانی بدهید. ردیف کوچک آنجا (کپی، لایک، تلاش دوباره) معمولاً یک گزینهٔ بازتولید یا «دوباره امتحان کن» دارد، و در ChatGPT آن منو اجازه میدهد پرسش را دوباره به یک مدل نامبردهشده بفرستید. برای اجبارکردن مدلی قویتر مفید است، اما آن را راهی برای دوبارهپرسیدن بدانید، نه یک رسید: تا اوت 2026 نتوانستیم از مستندات خودِ OpenAI تأیید کنیم که ChatGPT برچسب میزند کدام مدل پاسخی را که همین حالا جلوی شماست تولید کرده. تشخیصتان را حول پیداکردن یک برچسب برای هر پیام برنامهریزی نکنید.
- صفحهٔ مصرف یا محدودیتها در تنظیمات حساب. بررسیش کنید، اما زیاد انتظار نداشته باشید: پلنهای مصرفی بهطور قابلاعتماد یک شمارندهٔ درحالاجرا نشان نمیدهند، و زمان بازنشانی بیشتر داخل پیام محدودیت میآید تا در یک صفحهٔ تنظیمات.
- اعلان در لحظهٔ تعویض. وقتی یکی ظاهر شود، داخل رشتهٔ گفتگو مینشیند نه بهعنوان یک پاپآپ، پس اگر از آن رد شدید، همچنان آنجا در متن گفتگو هست.
- از چتبات نپرسید کدام مدل است. یک مدل بهطور قابلاعتماد نام یا نسخهٔ خودش را نمیداند، و با اطمینان هرچه در متن آموزشیاش بیشتر بحث شده را نام میبرد. آن پاسخ هیچ ارزشی ندارد. چرا هوش مصنوعی اشتباه میکند این دسته از یاوهگویی مطمئن را پوشش میدهد.
چون هرکدام از اینها به رابطی وابستهاند که عوض میشود، بررسیای که واقعاً پابرجا میماند، رفتاری است. یک prompt کوتاهِ محکزن را جایی ذخیره نگه دارید، چیزی که پاسخ خوبش را فوری تشخیص میدهید. یک بازنویسی سخت، یک معمای منطقی کوچک از کار خودتان. وقتی کیفیت درست بهنظر نمیرسد، آن را بفرستید. ظرف چند ثانیه میفهمید آیا با مدلی که فکر میکنید حرف میزنید یا نه، و هیچ بازطراحیای نمیتواند این را از شما بگیرد.
چرا مدل کوچکتر متفاوت حس میشود
مدل جایگزین نسخهٔ خرابشدهٔ مدل بزرگ نیست. یک مدل متفاوت و کوچکتر است، جداگانه آموزشدیده، انتخابشده چون اجرایش خیلی ارزانتر است. مدلهای کوچکتر واقعاً در اکثریت درخواستهای آسان خوباند، به همین دلیل اصلاً بهعنوان جایگزین کار میکنند. آنها در یک الگوی مشخص شکست میخورند، و وقتی آن الگو را بشناسید، میتوانید تعویض را بدون هیچ رابطی تشخیص دهید.
- حافظهٔ کاری کوتاهتر در عمل. مدل کوچکتر اغلب پنجرهٔ زمینهٔ کوچکتری دارد، و حتی جایی که پنجرهٔ اعلامشده مشابه است، جزئیات اولیه را کمتر قابلاعتماد نگه میدارد. علامتش این است که چیزی را که بیست پیام پیش حل کردید دوباره توضیح میدهید، یا محدودیتی را که در ابتدا گذاشتید رها میکنید. پنجرهٔ زمینه چیست توضیح میدهد چرا کیفیت اغلب پیش از رسیدن به محدودیت افت میکند.
- دنبالکردن ضعیفتر دستورالعمل، بهخصوص دستورالعملهای تلنبارشده. یک دستورالعمل را دنبال میکند. چهار تا همزمان («زیر 200 کلمه، بدون گلوله، دومشخص، نام مشتری را بیرون بگذار») همانجایی است که شروع میکند بیسروصدا یکی دو تا را حذف کند. این قابلاعتمادترین نشانه است.
- ساختار تختتر. پاسخها به سمت یک شکل عمومی میروند: مقدمهٔ کوتاه، سه سرتیتر، خلاصه. مدل بزرگتر بهتر تصمیم میگیرد که پرسش شما شکل متفاوتی لایق است.
- خطاهای مطمئنتر. همان صدای روان، کمی توانایی کمتر پشتش، پس فاصلهٔ میان اینکه چقدر مطمئن بهنظر میرسد و چقدر درست است، بیشتر میشود.
- استدلال چندمرحلهای ضعیفتر. هرچیزی که به چند نتیجهٔ میانی همزمان نیاز دارد (محاسبهای با شرط، برنامهای با وابستگی، عیبیابی) خیلی بیشتر از یک بازنویسی افت میکند.
توجه کنید چه چیزی از آن فهرست جا افتاده: گفتگوی معمولی، بازنویسیهای کوتاه، توضیحهای سریع، عوضکردن لحن، مرتبکردن یک پاراگراف. روی آن کارها، مدل کوچکتر تقریباً غیرقابلتشخیص و سریعتر است. این طراحی است، نه تصادف. جایگزین فقط وقتی مشکل است که روی درخواستهایی بیفتد که به مدل بزرگتر نیاز داشتند، و شما نمیتوانید ببینید کدامیک را گرفتید.
یک چیز دیگر که باید کنار جایگزینی نگه دارید: دستیارها همزمان بهطور خودکار مسیریابی میکنند، و برایتان تصمیم میگیرند پرسشی مدل سریع لایق است یا مدل استدلالی کندتر. وقتی آن مسیریاب دوباره تنظیم میشود، promptهای یکسان با عمقی متفاوت از هفتهٔ پیش برمیگردند، که از بیرون دقیقاً شبیه بدترشدن مدل بهنظر میرسد. میان جایگزینی و مسیریابی، یک اپ تنها بدون گفتن به شما تصمیم میگیرد، پس نمیتوانید «مدل عوض شد» را از «مرا جابهجا کردند» و از «پرسش بدتری پرسیدم» جدا کنید.
چه باید کرد
بهطور تقریبی به ترتیب تلاش. سه مورد اول رایگاناند و چند دقیقه طول میکشند.
- پیش از شکایتکردن تأیید کنید. prompt محکزن ذخیرهشدهتان را اجرا کنید. اگر پاسخ تختتر از آن چیزی برگردد که میدانید آن prompt لایقش است، روی مدل جایگزین هستید و معمولاً وقتی پنجره از نو تنظیم شود به حالت عادی برمیگردید.
- مدل قوی را بودجهبندی کنید. کارهای دورریختنی (بازنویسی، طوفان فکری، پرسشهای سریع) را جایی ارزان انجام دهید. رشتههای طولانی و بیتمرکز سریعترین راه برای تمامکردن سهمیهاند.
- برای هر کار یک چت تازه شروع کنید. رشتههای طولانی کل تاریخچه را در هر درخواست حمل میکنند، که هزینهاش بیشتر است و مدل جایگزین کوچکتر را زودتر به دردسر میاندازد.
- وقتی روی مدل کوچک هستید، دستورالعمل را تقسیم کنید. یک دستورالعمل را قابلاعتماد دنبال میکند و چهار تا را غیرقابلاعتماد، پس چهار پیام بفرستید.
- هرچیزی که میخواهید روی آن عمل کنید را تأیید کنید. در پنجرهٔ جایگزینی، اطمینان بالا میماند درحالیکه دقت افت میکند. دقیقاً همانجاست که یک عدد اشتباه سر میخورد و رد میشود.
- یک مدل قوی دوم را در دسترس نگه دارید. غافلگیری فقط وقتی آسیب میزند که یک اپ تنها تصمیم مسیریابی را در دست دارد و شما جای دیگری برای رفتن ندارید وقتی جابهجایتان میکند. یک حساب دوم، یا فضای کاریای که چند مدل را همزمان نگه میدارد، یک تنزل ساکت را به یک انتخاب خودتان تبدیل میکند.
هیچکدام از اینها محدودیت نرخ را از بین نمیبرد، و هیچکس نباید خلاف این را بگوید. ظرفیت همهجا پول هزینه دارد. چیزی که عوض میشود این است که محدودیت قابلدیدن و قابلبازیابی میشود، بهجای اینکه یک هفته بعد بفهمید نیمی از کارتان توسط مدلی نوشته شده که هرگز انتخابش نکردید. اگر مطمئن نیستید کدام مدل برای کدام کار مناسب است، چطور یک مدل هوش مصنوعی انتخاب کنیم یک چارچوب است، نه یک جدول ردهبندی.
- پیش از تصمیمگرفتن دربارهٔ اینکه خودِ محصول بدتر شده، prompt محکزنتان را بفرستید.
- هرگز از چتبات نپرسید کدام مدل است، چون بهطور قابلاعتماد نمیداند.
- یک prompt محکزن ذخیرهشده نگه دارید که پاسخ خوبش را فوری تشخیص دهید.
- سقفهای فعلیتان را در صفحهٔ محدودیتهای خودِ ارائهدهنده بررسی کنید، نه در یک مقاله.
- وقتی روی یک مدل کوچکتر گیر کردهاید، یک دستورالعمل در هر بار بفرستید.
- برای هر کار یک چت تازه شروع کنید تا رشتههای طولانی سهمیه را تمام نکنند.
- پیش از نیازتان، یک مدل قوی از یک شرکت دوم را در دسترس نگه دارید.
پرسشهای متداول
چرا ChatGPT مرا به یک مدل mini عوض کرد؟
تقریباً همیشه چون سهمیهتان را روی مدل اصلی در پنجرهٔ مصرف فعلی تمام کردهاید. بهجای مسدودکردن گفتگو، ChatGPT آن را به یک مدل جایگزین کوچکتر میسپارد و همچنان پاسخ میدهد. OpenAI این را در یادداشتهای انتشار مدلش مستند کرده، از جمله اینکه مدل جایگزین عمداً از فهرست کشویی مدلها غایب است.
این تنزل چقدر طول میکشد؟
تا وقتی سهمیهتان پر شود، و ساختار پشت آن بدون اعلام زیادی عوض میشود. OpenAI برای سالها از یک پنجرهٔ متحرک چند ساعته استفاده میکرد، پلن رایگان حدود ژوئیه 2026 بهنظر میرسید به یک سهمیهٔ هفتگی یگانه تغییر کرده، و اوایل اوت 2026 OpenAI چت متن سادهٔ نامحدود در همهٔ ردهها را اعلام کرد، درحالیکه استدلال، فایل، تصویر و صدا همچنان جداگانه سنجیده میشوند. هیچکدام از این ساختارها در نیمهشب محلی شما بازنشانی نمیشوند. حساب خودتان تنها جای قابلاعتماد برای دیدن بازنشانیای است که برایتان صدق میکند.
چطور بفهمم کدام مدل به یک پیام خاص پاسخ داده؟
اغلب نمیتوانید، دستکم نه از رابط کاربری. فهرست کشویی بالای چت نشان میدهد چه چیزی انتخاب شده، که در پنجرهٔ جایگزینی همان چیز نیست، و تا اوت 2026 نتوانستیم تأیید کنیم که ChatGPT پاسخهای تکتک را با مدلی که نوشته برچسب میزند. بررسی قابلاعتماد رفتاری است: یک prompt ذخیرهشده که پاسخ خوبش را فوری تشخیص میدهید بفرستید و مقایسه کنید. از خودِ مدل نپرسید، چون بهطور قابلاعتماد هویت خودش را نمیداند.
آیا مدل mini واقعاً بدتر است، یا فقط بدتر حس میشود؟
واقعاً یک مدل کوچکتر است، پس در استدلال چندمرحلهای، در دنبالکردن چند دستورالعمل تلنبارشده همزمان، و در نگهداشتن جزئیات در طول یک گفتگوی طولانی ضعیفتر است. در بازنویسیهای کوتاه، خلاصهها و پرسشهای معمولی، تفاوت کم است و سریعتر است. مشکل این است که نمیتوانید ببینید کِی روی آن هستید.
آیا پرداخت بیشتر جلوی این را میگیرد؟
سقف را بالا میبرد، نه اینکه بردارد. ردههای بالاتر سهمیهٔ بزرگتری میگیرند، اما هر پلن مصرفی بهنوعی مصرف را میسنجد، و کاربران پرمصرف در پلنهای پولی همچنان به سقف میرسند و همچنان به یک جایگزین منتقل میشوند. ارتقا را خریدن فضای بیشتر بدانید، نه مصونیت.
آیا دستیارهای دیگر هوش مصنوعی هم همین کار را میکنند؟
جایگزینی و مسیریابی خودکار در کل صنعت رایج است، نه مختص یک شرکت. Gemini CLI گوگل وقتی به محدودیتها میرسد از یک مدل Pro به یک مدل سریعتر Flash میافتد (ردهی رایگانش با یک حساب شخصی Google اجازهٔ 60 درخواست مدل در دقیقه و 1,000 در روز میدهد)، و این پیادهسازی صادقانهتری است چون خطی در همان نشست چاپ میکند که میگوید این کار را کرده. Anthropic یک مدل جایگزین قابلتنظیم در Claude Code برای وقتی که مدل اصلی پربار است مستند کرده. جزئیات بین محصولات فرق دارد، پس هر ابزاری را که به آن تکیه میکنید بررسی کنید بهجای اینکه فرض کنید دستیارتان مثل همانی که در این مقاله آمده رفتار میکند.