Как переключать модели ИИ прямо в разговоре в Whizi

Краткий ответ

Да. В Whizi можно переключаться между GPT, Claude, Gemini и любой другой моделью прямо внутри одного разговора, меняя активную модель для каждого сообщения через переключатель. Весь тред переносится целиком: ваши сообщения, ответы предыдущей модели и прикреплённые файлы. Каждый ход тарифицируется по стоимости в кредитах той модели, которая на него отвечает.

Короткий ответ

Да: вы можете использовать GPT, Claude, Gemini и любую другую модель в одном разговоре, переключаясь между ними для каждого сообщения через переключатель моделей. Весь тред переносится через переключение: ваши сообщения, ответы предыдущей модели и прикреплённые файлы, поэтому Claude может раскритиковать то, что только что написал GPT, без повторной вставки чего-либо.

Каждый ход тарифицируется по стоимости в кредитах той модели, которая на него отвечает, и модель должна быть доступна в вашем тарифе. Остальная часть страницы о том, когда переключение окупается, а когда нет.

Что происходит при переключении

Новая модель получает весь разговор целиком, включая ваши сообщения, ответы предыдущей модели и любые прикреплённые файлы. С её точки зрения она присоединяется к уже идущему обсуждению, и ей видно всё.

Именно поэтому это отличается от копирования текста между тремя вкладками браузера. Когда вы вставляете текст в новый инструмент, вы приносите результат, но теряете ход рассуждений, ограничения, установленные за пять сообщений, и загруженный документ. Переключение на месте сохраняет всё это.

Стоит знать две вещи. Новая модель видит ответ предыдущей модели как часть разговора, и это может подтолкнуть её к согласию. Когда вам нужен по-настоящему независимый взгляд, скажите об этом прямо: Оцени приведённый выше ответ по существу. Мне нужна твоя собственная оценка, а не синтез уже сказанного. И бюджет ввода на один ход ограничен 40 000 токенов, причём у модели с маленьким контекстным окном этот бюджет пропорционально меньше, поэтому очень длинный тред обрезается под ту модель, на которую вы переключаетесь; сверх этого предела большее контекстное окно не передаёт больше информации из треда. Если после переключения ответ выглядит так, будто модель забыла начало обсуждения, обычно причина в бюджете контекста.

Четыре схемы, которые стоит освоить

1. Маршрутизация по фазам. Схема, к которой рано или поздно приходит большинство людей. Разные этапы одной задачи достаются разным моделям.

Структура в GPT, текст в Claude, проверка с включённым веб-поиском. Это применимо к посту, предложению, техническому заданию или отчёту, и работает потому, что это действительно три разных навыка, а не три уровня сложности одного и того же.

2. Второе мнение. Получите ответ, затем переключитесь и попросите новую модель его атаковать.

Коллега предложил ответ выше. Найди, что в нём не так: фактические ошибки, упущенные крайние случаи, более простой подход или допущение, которое не выдерживает проверки. Если он действительно верен, скажи это прямо, а не выдумывай возражения.

Есть два полезных результата. Либо перед тем, как вы начнёте действовать, всплывает реальный изъян, либо вторая модель соглашается, несмотря на то что её подталкивали к несогласию, а это уже значимое подтверждение. Повторные запросы к одной и той же модели не дают ни того, ни другого, потому что модели склонны соглашаться сами с собой.

3. Переформулировка. Когда объяснение не заходит, переключитесь, а не перечитывайте его снова.

Claude и GPT по-разному формулируют одно и то же объяснение, и часто именно второй вариант формулировки попадает в цель. Это самая недооценённая причина держать под рукой больше одной модели, и стоит она один клик.

4. Маршрутизация по возможностям. Переключайтесь, потому что только одна модель способна сделать нужное.

Документ на 300 страниц отправляется модели с контекстным окном на миллион токенов. Изображение отправляется модели, умеющей читать изображения. Вопрос о прошлой неделе: единственный случай, который вообще не требует переключения. Веб-поиск в Whizi включается тумблером на уровне разговора в поле ввода, он работает на той же модели, которой вы уже пользуетесь, и включение ничего не стоит в кредитах. Всё остальное не вопрос предпочтений, а жёсткое ограничение, именно в этом случае подписка на одну модель просто перестаёт справляться.

Какая модель для какой фазы

Это отправная точка, а не правило. Ваши собственные задачи должны переопределить её уже через неделю внимательного использования.

ФазаМодельПочему
Мозговой штурм, структура, планGPTБыстро, точно следует брифу, чистая иерархия
Черновик текста, тон, убеждениеClaudeМеньше всего воды, держит голос, лучше всего справляется со сложным тоном
Исследование, свежие факты, источникиЛюбая модель с включённым веб-поискомПоиск это настройка на уровне разговора в поле ввода, а не свойство модели
Длинные документы, большие массивы текстаGeminiКонтекстное окно 1 млн токенов на текущих тарифах
Строгие форматы, таблицы, JSONGPTНаиболее надёжно соблюдает точную схему
Критика и стресс-тестЛюбая модель, которая это не писалаНезависимость и есть весь смысл

В таблице названы три семейства, с которых начинает большинство людей, но переключатель предлагает гораздо больше. У каждого семейства открытых весов есть собственная справочная страница со стоимостью в кредитах за сообщение и тарифом, который открывает эту строку: Llama, Mistral, Kimi и GLM.

Единственное правило, которого стоит держаться независимо от задачи: модель, которая критикует, никогда не должна быть той же, что писала черновик.

Как сделать переключение по-настоящему полезным

Переключение помогает больше всего, когда вы прямо говорите новой модели, чего от неё хотите. Переключение без пояснений даст лишь продолжение того же разговора чуть другим голосом.

Передача фазы

Теперь у нас есть план выше. Напиши только раздел 2. Используй перечисленные под ним аргументы. Голос: [вставьте образец]. Не пересказывай план заново.

Запрос независимости

Игнорируй заданную выше рамку и ответь на это с нуля: [сформулируйте вопрос заново]. Мне нужен по-настоящему независимый взгляд, а не доработка уже сказанного.

Полная смена задачи

Прекрати писать черновик. Переключись на рецензирование. Вот критерий: [укажите его]. Сообщай только о проблемах, не переписывай текст.

Ещё одна полезная привычка: когда переключение даёт заметно лучший результат, отмечайте, какая модель и на какой фазе. Через пару недель у вас появится карта маршрутизации, характерная именно для вашей работы, а не для бенчмарка, и она стоит дороже любого опубликованного сравнения.

Когда не стоит переключаться

Переключение дёшево, но не бесплатно, и бывают случаи, когда оно только всё портит.

  • Посреди черновика ради стиля. Смена модели на середине большого текста создаёт заметный шов, потому что именно согласованность голоса и меняется между моделями. Сначала закончите черновик, потом переключайтесь для критики.
  • Когда задача не сформулирована. Переключение не исправляет расплывчатый промпт. Если первый ответ оказался бесполезным из-за нечёткого вопроса, другая модель даст другой бесполезный ответ.
  • Ради поиска согласия. Перебирать модели, пока одна не скажет то, что вы хотите услышать, это способ узаконить решение, которое вы уже приняли. Если два из трёх не согласны, вот вам и результат.
  • В очень длинном треде, переключаясь на модель с меньшим контекстом. Если ранний контекст важен, а тред огромен, либо оставайтесь с моделью с большим контекстом, либо сначала сделайте краткое резюме треда и начните заново.

Про запуск двух моделей на один и тот же промпт одновременно, а не по очереди, читайте в статье сравнение моделей бок о бок.

Чек-лист
  • Назначьте модель для каждой фазы задачи ещё до начала работы
  • Скажите новой модели, какую задачу она принимает, а не просто продолжайте разговор
  • Просите независимость прямо, когда хотите получить настоящее второе мнение
  • Никогда не позволяйте модели, написавшей черновик, быть и той, что его критикует
  • Переключайтесь, когда объяснение не заходит, вместо того чтобы перечитывать то же самое
  • Заканчивайте черновик перед переключением, чтобы голос оставался последовательным
  • Ведите заметки о том, какая модель выигрывает в какой фазе именно в вашей работе

Частые вопросы

Видит ли следующая модель весь разговор?

Да. Whizi по умолчанию передаёт весь контекст разговора дальше, включая ваши сообщения, ответы предыдущих моделей и прикреплённые файлы, поэтому новая модель подключается, уже видя всё. Единственная оговорка: бюджет ввода на один ход, который ограничен 40 000 токенов и пропорционально меньше у моделей с маленьким контекстным окном: очень длинный тред обрезается под этот лимит. Ответ, который как будто забыл начало долгого обсуждения, обычно упирается именно в этот бюджет, а не отражает свойство той модели, на которую вы переключились.

Можно ли скрыть часть треда от конкретной модели?

Да, можно разветвить тред или начать новый чат только с тем контекстом, который нужно перенести, это верный подход и для чувствительных фрагментов, и для длинных тредов, накопивших ненужные детали. Начать с нуля с коротким резюме важного часто даёт ответы лучше, чем перенос сорока сообщений истории, поскольку старый контекст отвлекает внимание от самого вопроса.

Изменится ли стиль текста, если переключить модель посреди черновика?

Да, и заметно, поэтому стоит дописывать черновик в одной модели перед переключением. Именно согласованность голоса отличается от модели к модели, поэтому передача черновика на полпути оставляет заметный шов. Продуктивная схема: писать черновик целиком в одной модели, а затем переключаться для критики, проверки фактов или структурированной выборки.

Есть ли автоматическая маршрутизация моделей?

Да, в виде одной строки переключателя под названием Auto. Она читает каждое сообщение, распределяет его по одной из шести фиксированных ступеней и отвечает моделью, закреплённой за этой ступенью, никогда выше того, что открывает ваш тариф. Никаких правил маршрутизации писать не нужно: в настройках нет ничего, что меняло бы эту лестницу, взвешивало ступень или закрепляло Auto за конкретной моделью. Выбор модели вручную остаётся решением на уровне каждого сообщения, и привычка выбирать вручную по фазам обычно учит больше о том, какая модель реально подходит для вашей работы.

Считается ли переключение дополнительными сообщениями?

Смена модели в переключателе сама по себе ничего не отправляет, поэтому ничего не списывается до вашего следующего сообщения. Каждый ход тарифицируется по стоимости в кредитах той модели, которая на него отвечает, поэтому цена следующего ответа меняется вместе с переключением: сообщение, на которое отвечает модель за 1 кредит, стоит 1 кредит, а то же сообщение, на которое отвечает модель за 20 кредитов, стоит 20; шкала кредитов перечисляет стоимость каждой модели. Задать тот же вопрос второй модели значит получить второй платный ход, и это того стоит, когда ответ важен.