Коротка відповідь
Так: ви можете використовувати GPT, Claude, Gemini та будь-яку іншу модель у межах однієї розмови, перемикаючись між ними для кожного повідомлення через селектор моделей. Увесь потік переноситься через перемикання: ваші повідомлення, відповіді попередньої моделі та прикріплені файли, тож Claude може розкритикувати щойно написане GPT без потреби щось перевставляти.
Кожен хід оплачується за кредитною вартістю тієї моделі, яка на нього відповідає, і ця модель має бути доступна у вашому плані. Решта сторінки про те, коли перемикання виправдовує себе, а коли ні.
Що відбувається при перемиканні
Нова модель отримує всю розмову до цього моменту, включно з вашими повідомленнями, відповідями попередньої моделі та будь-якими прикріпленими файлами. З її погляду вона приєднується до вже розпочатої дискусії, і все вже видно.
Саме тому це відрізняється від копіювання тексту між трьома вкладками браузера. Коли ви вставляєте текст в новий інструмент, ви переносите результат, але втрачаєте хід міркувань, обмеження, встановлені за п'ять повідомлень, і завантажений документ. Перемикання на місці зберігає все це.
Варто знати дві речі. Нова модель бачить відповідь попередньої моделі як частину розмови, і це може схилити її до згоди. Коли вам потрібен справді незалежний погляд, скажіть про це прямо: Оціни відповідь вище по суті. Мені потрібна саме твоя оцінка, а не синтез уже сказаного. І бюджет вхідних токенів на один хід обмежений 40 000 токенів, причому модель із меншим контекстним вікном отримує пропорційно менше, тож дуже довгий потік обрізається під ту модель, на яку ви перемикаєтеся; за цією межею більше контекстне вікно не передає більше вмісту потоку. Якщо після перемикання відповідь виглядає так, ніби забула початок дискусії, зазвичай причина саме в бюджеті контексту.
Чотири схеми, які варто засвоїти
1. Маршрутизація за фазами. Схема, до якої приходить більшість людей. Різні етапи одного завдання йдуть до різних моделей.
Структура в GPT, текст у Claude, перевірка з увімкненим веб-пошуком. Це працює для написання поста, пропозиції, технічного завдання чи звіту, і працює тому, що це дійсно три різні навички, а не три рівні складності однієї.
2. Друга думка. Отримайте відповідь, потім перемкніться і попросіть нову модель піддати її критиці.
Колега запропонував відповідь вище. Знайди, що в ній не так: фактичні помилки, пропущені крайні випадки, простіший підхід або хибне припущення. Якщо вона дійсно правильна, скажи це прямо, а не вигадуй заперечення.
Два корисні результати. Або справжня хиба виявляється до того, як ви на неї покладетеся, або друга модель погоджується попри спонукання заперечити, а це вже значуще підтвердження. Повторні запити тій самій моделі не дають ні того, ні іншого, бо моделі схильні погоджуватися самі з собою.
3. Переформулювання. Коли пояснення не заходить, перемкніться, а не перечитуйте.
Claude і GPT пояснюють одне й те саме поняття з дійсно різними ракурсами, і саме друге формулювання часто виявляється тим, що клацає. Це найбільш недооцінена причина мати під рукою більш ніж одну модель, і коштує вона один клік.
4. Маршрутизація за можливостями. Перемикайтеся, бо завдання під силу лише одній моделі.
Документ на 300 сторінок піде до моделі з контекстним вікном на мільйон токенів. Зображення піде до моделі, що вміє читати зображення. Питання про минулий тиждень, і це той єдиний випадок, коли перемикання взагалі не потрібне: веб-пошук у Whizi це перемикач на рівні розмови в полі вводу, він працює на тій самій моделі, яку ви вже використовуєте, і його увімкнення нічого не коштує в кредитах. Решта не питання переваги, а жорстке обмеження, і саме тут одна-єдина модель за підпискою просто зупиняється.
Яка модель для якої фази
Це відправна точка, а не правило. Ваші власні завдання мають перекрити її вже за тиждень уваги.
| Фаза | Модель | Чому |
|---|---|---|
| Мозковий штурм, структура, план | GPT | Швидка, точно дотримується завдання, чисті ієрархії |
| Написання тексту, тон, переконливість | Claude | Найменше води, тримає голос, найкраще з важким тоном |
| Дослідження, свіжі факти, джерела | Будь-яка модель з увімкненим веб-пошуком | Пошук це налаштування на рівні розмови в полі вводу, а не властивість моделі |
| Довгі документи, великі масиви | Gemini | Контекстне вікно 1 млн токенів у поточних рядках |
| Суворі формати, таблиці, JSON | GPT | Найнадійніша у дотриманні точної схеми |
| Критика та стрес-тест | Будь-яка модель, що це не писала | Незалежність тут головне |
У таблиці названо три родини, з якими приходить більшість людей, а вибір значно ширший. Кожна родина з відкритими вагами має свою довідкову сторінку з кредитною вартістю за повідомлення і планом, що відкриває кожен рядок: Llama, Mistral, Kimi та GLM.
Одне правило варто тримати незалежно від завдання: модель, що критикує, ніколи не має бути тією ж, що писала чернетку.
Як зробити перемикання дійсно корисним
Перемикання допомагає найбільше, коли ви кажете новій моделі, чого від неї хочете. Просте перемикання без пояснень дасть вам продовження тієї самої розмови трохи іншим голосом.
Передача фази
Тепер у нас є план вище. Напиши лише розділ 2. Використай докази, перелічені під ним. Голос: [вставте зразок]. Не переказуй план назад мені.
Запит на незалежність
Ігноруй рамки, встановлені вище, і дай відповідь з нуля: [сформулюй питання заново]. Мені потрібен справді незалежний погляд, а не доопрацювання вже сказаного.
Повна зміна завдання
Припини писати чернетку. Перейди до перевірки. Ось критерій: [вкажіть його]. Повідом лише про проблеми, нічого не переписуй.
Ще одна корисна звичка: коли перемикання дає помітно кращий результат, занотуйте, яка модель і яка фаза. За кілька тижнів у вас складеться карта маршрутизації, специфічна саме для вашої роботи, а не для бенчмарку, і ця карта цінніша за будь-яке опубліковане порівняння.
Коли не варто перемикатися
Перемикання дешеве, але не безкоштовне, і є випадки, коли воно тільки погіршує справу.
- Посеред чернетки, заради стилю. Зміна моделі на півдорозі довгого тексту створює помітний шов, бо саме послідовність голосу і є тим, що змінюється між моделями. Завершіть чернетку, а тоді перемикайтеся для критики.
- Коли завдання ще не визначене. Перемикання не виправляє розпливчастий запит. Якщо перша відповідь була некорисною через незрозуміле питання, інша модель дасть іншу некорисну відповідь.
- У пошуках згоди. Перебирання моделей, доки одна не скаже те, що ви хочете почути, це спосіб легалізувати рішення, яке ви вже прийняли. Якщо двоє з трьох не погоджуються, це і є висновок.
- У дуже довгому потоці, на модель з меншим контекстом. Якщо ранній контекст важливий, а потік величезний, або залишайтеся з моделлю з великим контекстом, або спершу підсумуйте потік і почніть спочатку.
Про одночасний, а не послідовний запуск двох моделей на одному запиті читайте у розділі порівняння моделей поряд.
- Призначте модель для кожної фази завдання ще до початку
- Скажіть новій моделі, яке завдання вона переймає, а не просто продовжуйте
- Прямо просіть про незалежність, коли хочете справжню другу думку
- Ніколи не давайте моделі, що писала чернетку, самій же її критикувати
- Перемикайтеся, коли пояснення не заходить, замість того щоб перечитувати те саме
- Завершуйте чернетку перед перемиканням, щоб голос лишався послідовним
- Ведіть нотатки про те, яка модель виграє яку фазу саме у вашій роботі
Поширені запитання
Чи бачить наступна модель усю розмову?
Так. Whizi за замовчуванням передає весь контекст розмови далі, включно з вашими повідомленнями, відповідями попередніх моделей і прикріпленими файлами, тож нова модель приєднується з усім видимим уже. Єдине застереження, бюджет вхідних токенів на один хід обмежений 40 000 токенів і пропорційно менший на моделях з малим контекстним вікном: дуже довгий потік обрізається під цю межу. Відповідь, що ніби забула початок довгої дискусії, зазвичай впирається саме в цей бюджет, а не є властивістю моделі, на яку ви перемкнулися.
Чи можна приховати частину потоку від конкретної моделі?
Ви можете розгалузити потік або почати новий чат лише з тим контекстом, який хочете перенести, і це правильний підхід для чутливих фрагментів, а також для довгих потоків, що накопичили зайві деталі. Чистий старт із коротким підсумком того, що важливо, часто дає кращі відповіді, ніж перенесення сорока повідомлень історії, оскільки старий контекст конкурує за увагу з самим питанням.
Чи зміниться стиль тексту, якщо перемкнути модель посеред чернетки?
Так, і помітно, тому варто завершувати чернетку в одній моделі перед перемиканням. Послідовність голосу це якраз те, чим моделі відрізняються, тож передача завдання на півдорозі довгого тексту лишає помітний шов. Продуктивна схема така: писати чернетку повністю в одній моделі, а тоді перемикатися для критики, перевірки фактів або структурованого витягу.
Чи є автоматична маршрутизація моделей?
Так, як єдиний рядок у селекторі під назвою Auto. Він читає кожне повідомлення, відносить його до одного з шести фіксованих щаблів і відповідає на моделі, закріпленій за цим щаблем, ніколи вище того, що відкриває ваш план. Правил маршрутизації для написання немає: у Налаштуваннях нічого не редагує драбину, не зважує щабель і не закріплює Auto за конкретною моделлю. Вибір моделі вручну лишається рішенням на рівні кожного повідомлення, і саме звичка обирати модель за фазою зазвичай учить вас найбільше про те, яка модель дійсно підходить вашій роботі.
Чи рахується перемикання як додаткові повідомлення?
Зміна моделі в селекторі нічого не надсилає, тож нічого не списується до наступного вашого повідомлення. Кожен хід оплачується за кредитною вартістю тієї моделі, яка на нього відповідає, тож ціна наступної відповіді змінюється разом із перемиканням: повідомлення, на яке відповідає модель за 1 кредит, коштує 1 кредит, а те саме повідомлення від моделі за 20 кредитів коштує 20; шкала кредитів наводить вартість кожної моделі. Питати те саме в другої моделі це другий оплачуваний хід, і він вартий того, коли відповідь має значення.