Como trocar de modelo de IA no meio da conversa no Whizi

Resposta rápida

Sim. Você pode alternar entre GPT, Claude, Gemini e qualquer outro modelo dentro de uma única conversa no Whizi, mudando o modelo ativo a cada mensagem pelo seletor. Toda a conversa é levada adiante: suas mensagens, as respostas do modelo anterior e os arquivos anexados. Cada turno é cobrado no custo em créditos do modelo que responde.

A resposta curta

Sim: você pode usar GPT, Claude, Gemini e qualquer outro modelo na mesma conversa, alternando entre eles a cada mensagem pelo seletor de modelo. Toda a conversa é levada adiante na troca: suas mensagens, as respostas do modelo anterior e os arquivos anexados, de forma que o Claude possa criticar o que o GPT acabou de escrever sem que você precise colar nada de novo.

Cada turno é cobrado no custo em créditos do modelo que responde, e o modelo precisa estar incluído no seu plano. O restante desta página trata de quando trocar compensa e quando não.

O que acontece quando você troca

O novo modelo recebe toda a conversa até aquele ponto, incluindo suas mensagens, as respostas do modelo anterior e qualquer arquivo anexado. Do ponto de vista dele, é como entrar em uma discussão já em andamento, com tudo visível.

É por isso que isso é diferente de copiar texto entre três abas do navegador. Ao colar em uma ferramenta nova você leva o resultado, mas perde o raciocínio, as restrições que você estabeleceu ao longo de cinco mensagens e o documento que enviou. Trocar no mesmo lugar mantém tudo isso.

Duas coisas valem a pena saber. O novo modelo enxerga a resposta do modelo anterior como parte da conversa, o que pode ancorá-lo em direção à concordância. Quando você quiser uma visão genuinamente independente, diga isso explicitamente: Avalie a resposta acima pelo seu mérito. Quero sua avaliação, não uma síntese do que já foi dito. E o orçamento de entrada por turno tem o teto de 40.000 tokens, com um modelo cuja janela de contexto seja menor recebendo proporcionalmente menos, de modo que uma conversa muito longa é ajustada para caber em qualquer modelo para o qual você troque; passado esse limite, uma janela de contexto maior não envia mais da conversa. Se uma troca produzir uma resposta que parece ter esquecido o início da discussão, o orçamento de contexto costuma ser o motivo.

Os quatro padrões que vale a pena aprender

1. Roteamento por fase. O fluxo de trabalho para o qual a maioria das pessoas converge. Diferentes etapas de uma mesma tarefa vão para modelos diferentes.

Estrutura no GPT, prosa no Claude, verificação com a pesquisa na web ativada. Isso se aplica a escrever um post, uma proposta, uma especificação ou um relatório, e funciona porque essas são de fato três habilidades diferentes, e não três níveis de dificuldade da mesma habilidade.

2. A segunda opinião. Consiga uma resposta, depois troque e peça ao novo modelo que ataque essa resposta.

Um colega propôs a resposta acima. Encontre o que está errado nela: erros factuais, casos extremos não considerados, uma abordagem mais simples ou uma suposição que não se sustenta. Se ela for realmente sólida, diga isso claramente em vez de inventar objeções.

Dois resultados úteis. Ou uma falha real aparece antes que você aja com base nela, ou o segundo modelo concorda mesmo tendo sido incentivado a discordar, o que é uma confirmação significativa. Iterar com o mesmo modelo não produz nenhum dos dois, porque os modelos tendem a concordar consigo mesmos.

3. O reenquadramento. Quando uma explicação não faz sentido, troque em vez de reler.

Claude e GPT explicam o mesmo conceito com enquadramentos genuinamente diferentes, e o segundo enquadramento é, com frequência, o que faz clique. Esse é o motivo mais subestimado para ter mais de um modelo disponível, e custa apenas um clique.

4. Roteamento por capacidade. Troque porque só um modelo consegue fazer aquilo.

Um documento de 300 páginas vai para um modelo com janela de contexto de um milhão de tokens. Uma imagem vai para um modelo que consegue ler imagens. Uma pergunta sobre a semana passada é o único caso que não precisa de troca alguma: a pesquisa na web no Whizi é um alternador por conversa no compositor, roda no modelo que você já está usando e ativá-la não custa nada em créditos. O resto não é preferência, é uma restrição rígida, e é o caso em que uma assinatura de um único modelo simplesmente para de funcionar.

Qual modelo para qual fase

Um ponto de partida, não uma regra. Suas próprias tarefas devem sobrepor isso em uma semana de atenção.

FaseModeloPor quê
Brainstorm, estrutura, esboçoGPTRápido, segue um briefing à risca, hierarquias limpas
Redigir prosa, tom, persuasãoClaudeMenos enrolação, sustenta uma voz, o melhor em tom difícil
Pesquisa, fatos recentes, fontesQualquer modelo, com a pesquisa na web ativadaA pesquisa é uma configuração por conversa no compositor, não uma propriedade do modelo
Documentos longos, grandes corporaGeminiJanela de contexto de 1 milhão de tokens nas linhas atuais
Formatos rígidos, tabelas, JSONGPTO mais confiável em obedecer a um esquema exato
Crítica e red teamingQualquer um que não tenha escrito o textoA independência é todo o ponto

A tabela nomeia as três famílias com as quais a maioria das pessoas chega, e o seletor é mais amplo do que isso. As famílias de peso aberto têm cada uma sua própria página de referência, com o custo em créditos por mensagem e o plano que libera cada uma: Llama, Mistral, Kimi e GLM.

A única regra que vale manter independentemente da tarefa: o modelo que critica nunca deve ser o modelo que redigiu.

Fazendo a troca realmente compensar

Trocar ajuda mais quando você diz ao novo modelo o que espera dele. Entrar sem contexto nenhum resulta apenas na continuação da mesma conversa em uma voz um pouco diferente.

Repassando uma fase

Agora temos o esboço acima. Redija apenas a seção 2. Use as evidências listadas nela. Voz: [cole a amostra]. Não repita o esboço de volta para mim.

Pedindo independência

Ignore o enquadramento estabelecido acima e responda isto do zero: [reformule a pergunta]. Quero uma visão genuinamente independente, não um refinamento do que já está aqui.

Mudando completamente a tarefa

Pare de redigir. Passe a revisar. Aqui está o critério: [informe-o]. Reporte apenas problemas, não reescreva.

Mais um hábito útil: quando uma troca produz algo visivelmente melhor, anote qual modelo e qual fase. Depois de algumas semanas você terá um mapa de roteamento específico para o seu trabalho, e não para um benchmark, e esse mapa vale mais do que qualquer comparação publicada.

Quando não trocar

Trocar é barato, mas não é gratuito, e há casos em que isso piora as coisas.

  • No meio do rascunho, por causa do estilo. Trocar de modelo na metade de um texto longo produz uma costura visível, porque a consistência de voz é exatamente o que muda entre modelos. Termine o rascunho, depois troque para a crítica.
  • Quando você não definiu a tarefa. Trocar não corrige um prompt vago. Se a primeira resposta não foi útil porque a pergunta estava mal formulada, um modelo diferente dá a você uma resposta diferente, mas igualmente inútil.
  • Para encontrar concordância. Ficar trocando até um modelo dizer o que você quer ouvir é uma forma de legitimar uma decisão que você já tinha tomado. Se dois de três discordam, essa é a conclusão.
  • Em uma conversa muito longa, para um modelo com contexto menor. Se o contexto inicial importa e a conversa é enorme, ou você continua com o modelo de contexto grande, ou resume a conversa antes e começa do zero.

Para rodar dois modelos na mesma pergunta simultaneamente em vez de sequencialmente, veja comparar modelos lado a lado.

Lista de verificação
  • Atribua um modelo a cada fase da tarefa antes de começar
  • Diga ao novo modelo qual trabalho ele está assumindo, em vez de apenas continuar
  • Peça independência explicitamente quando quiser uma segunda opinião de verdade
  • Nunca deixe que o modelo que redigiu algo seja também o que faz a crítica
  • Troque quando uma explicação não fizer sentido, em vez de reler a mesma resposta
  • Termine um rascunho antes de trocar, para que a voz permaneça consistente
  • Mantenha anotações sobre qual modelo vence em qual fase para o seu próprio trabalho

Perguntas frequentes

O próximo modelo vê a conversa inteira?

Sim. O Whizi passa todo o contexto da conversa adiante por padrão, incluindo suas mensagens, as respostas dos modelos anteriores e os arquivos anexados, de forma que o novo modelo entra com tudo visível. A única ressalva é o orçamento de entrada por turno, que tem o teto de 40.000 tokens e é proporcionalmente menor em modelos com janelas de contexto pequenas: uma conversa muito longa é ajustada para caber nesse limite. Uma resposta que parece ter esquecido o início de uma discussão longa costuma estar esbarrando nesse orçamento, e não em uma característica do modelo para o qual você trocou.

Posso esconder parte da conversa de um modelo específico?

Você pode bifurcar a conversa ou começar um chat novo apenas com o contexto que quer levar adiante, o que é a abordagem certa para trechos sensíveis e também para conversas longas que acumularam detalhes irrelevantes. Começar do zero com um resumo curto do que importa costuma produzir respostas melhores do que carregar quarenta mensagens de histórico, já que o contexto mais antigo compete pela atenção com a pergunta real.

Trocar de modelo no meio do rascunho muda o estilo de escrita?

Sim, de forma perceptível, e esse é um motivo para terminar um rascunho em um modelo antes de trocar. A consistência de voz é exatamente o que difere entre modelos, então uma transição na metade de um texto longo deixa uma costura visível. O padrão produtivo é redigir inteiramente em um modelo, depois trocar para a crítica, a checagem de fatos ou uma extração estruturada.

Existe roteamento automático de modelo?

Sim, como uma única linha no seletor chamada Auto. Ela lê cada mensagem, classifica-a em um de seis degraus fixos e responde no modelo fixado nesse degrau, nunca acima do que seu plano pode liberar. Não há regras de roteamento para escrever: nada nas Configurações edita a escada, dá peso a um degrau ou fixa o Auto em um modelo. Escolher um modelo manualmente continua sendo uma decisão por mensagem, e o hábito manual de escolher por fase tende a ensinar mais sobre qual modelo realmente serve ao seu trabalho.

Trocar conta como mensagens extras?

Mudar o modelo no seletor não envia nada, então nada é cobrado até sua próxima mensagem. Cada turno é cobrado no custo em créditos do modelo que responde, então o preço da próxima resposta muda com a troca: uma mensagem respondida por um modelo de 1 crédito custa 1 crédito e a mesma mensagem respondida por um modelo de 20 créditos custa 20; a escala de créditos lista o custo de cada modelo. Fazer a mesma pergunta a um segundo modelo é um segundo turno cobrado, o que vale a pena quando a resposta importa.