Cómo cambiar de modelo de IA a mitad de conversación en Whizi

Respuesta rápida

Sí. Puedes cambiar entre GPT, Claude, Gemini y cualquier otro modelo dentro de una misma conversación en Whizi, cambiando el modelo activo por mensaje desde el selector. Todo el hilo se mantiene: tus mensajes, las respuestas del modelo anterior y tus archivos adjuntos. Cada turno se cobra al costo en créditos del modelo que responde.

La respuesta corta

Sí: puedes usar GPT, Claude, Gemini y cualquier otro modelo en la misma conversación, cambiando entre ellos por mensaje desde el selector de modelo. Todo el hilo se mantiene tras el cambio: tus mensajes, las respuestas del modelo anterior y tus archivos adjuntos, así Claude puede criticar lo que GPT acaba de escribir sin que tengas que volver a pegar nada.

Cada turno se cobra al costo en créditos del modelo que responde, y ese modelo debe estar incluido en tu plan. El resto de esta página trata sobre cuándo conviene cambiar y cuándo no.

Qué pasa cuando cambias de modelo

El nuevo modelo recibe toda la conversación hasta ese momento, incluidos tus mensajes, las respuestas del modelo anterior y cualquier archivo que hayas adjuntado. Desde su perspectiva, se une a una discusión ya en curso, con todo visible.

Por eso esto es distinto de copiar texto entre tres pestañas del navegador. Cuando pegas en una herramienta nueva llevas el resultado pero pierdes el razonamiento, las restricciones que estableciste en cinco mensajes y el documento que subiste. Cambiar en el mismo lugar conserva todo eso.

Vale la pena saber dos cosas. El nuevo modelo ve la salida del modelo anterior como parte de la conversación, lo que puede inclinarlo hacia el acuerdo. Cuando quieras una visión genuinamente independiente, dilo explícitamente: Evalúa la respuesta anterior por sus propios méritos. Quiero tu valoración, no una síntesis de lo que ya se ha dicho. Y el presupuesto de entrada por turno tiene un tope de 40.000 tokens, y un modelo con una ventana de contexto pequeña recibe proporcionalmente menos, así que un hilo muy largo se recorta para ajustarse al modelo al que cambies; superado ese límite, una ventana de contexto más grande no envía más hilo. Si un cambio produce una respuesta que parece haber olvidado el inicio de la discusión, el presupuesto de contexto suele ser la causa.

Los cuatro patrones que vale la pena aprender

1. Enrutamiento por fase. El flujo de trabajo al que converge la mayoría. Distintas etapas de una misma tarea van a distintos modelos.

Estructura en GPT, prosa en Claude, verificación con la búsqueda web activada. Se aplica a escribir una publicación, una propuesta, una especificación o un informe, y funciona porque de verdad son tres habilidades distintas, no tres niveles de dificultad de la misma habilidad.

2. La segunda opinión. Consigue una respuesta y luego cambia de modelo y pídele al nuevo que la ataque.

Un colega propuso la respuesta anterior. Encuentra lo que está mal en ella: errores factuales, casos límite pasados por alto, un enfoque más simple o una suposición que no se sostiene. Si en realidad es sólida, dilo con claridad en lugar de inventar objeciones.

Dos resultados útiles. O bien surge un fallo real antes de que actúes según él, o el segundo modelo está de acuerdo pese a que se le empujó a discrepar, lo cual es una confirmación significativa. Iterar con el mismo modelo no produce ninguno de los dos, porque los modelos tienden a estar de acuerdo consigo mismos.

3. El reencuadre. Cuando una explicación no termina de entenderse, cambia de modelo en vez de releerla.

Claude y GPT explican el mismo concepto con planteamientos genuinamente distintos, y a menudo es el segundo el que hace clic. Esta es la razón más infravalorada para tener más de un modelo disponible, y cuesta un solo clic.

4. Enrutamiento por capacidad. Cambias porque solo un modelo puede hacer la tarea.

Un documento de 300 páginas va a un modelo con una ventana de contexto de un millón de tokens. Una imagen va a un modelo que pueda leer imágenes. Una pregunta sobre la semana pasada es el único caso que no necesita ningún cambio: la búsqueda web en Whizi es un interruptor por conversación en el compositor, funciona sobre el modelo que ya estás usando y activarla no cuesta créditos. El resto no es cuestión de preferencia, es una restricción dura, y es el caso donde una suscripción a un solo modelo sencillamente se queda corta.

Qué modelo para cada fase

Un punto de partida, no una regla. Tus propias tareas deberían anularlo en cuanto le prestes atención una semana.

FaseModeloPor qué
Lluvia de ideas, estructura, esquemaGPTRápido, sigue el encargo al pie de la letra, jerarquías limpias
Redacción, tono, persuasiónClaudeEl que menos relleno tiene, sostiene una voz, el mejor con tonos difíciles
Investigación, hechos recientes, fuentesCualquier modelo, con la búsqueda web activadaLa búsqueda es un ajuste por conversación en el compositor, no una propiedad del modelo
Documentos largos, corpus extensosGeminiVentana de contexto de 1M de tokens en las filas actuales
Formatos estrictos, tablas, JSONGPTEl más fiable siguiendo un esquema exacto
Crítica y revisión adversariaCualquiera que no lo haya escritoLa independencia es todo el punto

La tabla nombra las tres familias con las que llega la mayoría, y el selector es más amplio que eso. Las familias de peso abierto tienen cada una su propia página de referencia, con el costo en créditos por mensaje y el plan que abre cada fila: Llama, Mistral, Kimi y GLM.

La única regla que vale la pena mantener sin importar la tarea: el modelo que critica nunca debe ser el que redactó.

Hacer que el cambio realmente valga la pena

Cambiar ayuda más cuando le dices al nuevo modelo qué quieres de él. Entrar sin ningún encuadre te da una continuación de la misma conversación con una voz ligeramente distinta.

Traspasar una fase

Ya tenemos el esquema anterior. Redacta solo la sección 2. Usa la evidencia listada debajo de ella. Voz: [pega una muestra]. No me repitas el esquema.

Pedir independencia

Ignora el encuadre establecido arriba y responde esto desde cero: [reformula la pregunta]. Quiero una postura genuinamente independiente, no un refinamiento de lo que ya hay aquí.

Cambiar el encargo por completo

Deja de redactar. Cambia a revisar. Este es el criterio: [indícalo]. Reporta solo problemas, no reescribas.

Un hábito más: cuando un cambio produce algo notablemente mejor, anota qué modelo y qué fase. Tras un par de semanas tendrás un mapa de enrutamiento específico a tu trabajo, en vez de a un benchmark, y ese mapa vale más que cualquier comparación publicada.

Cuándo no cambiar

Cambiar de modelo es barato pero no gratis, y hay casos en los que empeora las cosas.

  • A mitad de un borrador, por estilo. Cambiar de modelo a mitad de un texto largo produce una costura visible, porque la consistencia de voz es justo lo que cambia entre modelos. Termina el borrador y luego cambia para la crítica.
  • Cuando no has definido la tarea. Cambiar de modelo no arregla un prompt vago. Si la primera respuesta no sirvió porque la pregunta era confusa, un modelo distinto te dará una respuesta distinta pero igual de poco útil.
  • Para buscar consenso. Ir probando modelos hasta que uno te diga lo que quieres oír es una forma de blanquear una decisión que ya habías tomado. Si dos de tres discrepan, ese es el hallazgo.
  • En un hilo muy largo, hacia un modelo con menos contexto. Si el contexto inicial importa y el hilo es enorme, quédate con el modelo de contexto grande o resume el hilo primero y empieza de nuevo.

Para ejecutar dos modelos con el mismo prompt de forma simultánea en lugar de secuencial, consulta comparar modelos en paralelo.

Lista de comprobación
  • Asigna un modelo a cada fase de la tarea antes de empezar
  • Dile al nuevo modelo qué tarea está asumiendo, en vez de simplemente continuar
  • Pide independencia explícitamente cuando quieras una segunda opinión real
  • Nunca dejes que el modelo que redactó algo sea también el que lo critica
  • Cambia de modelo cuando una explicación no se entienda, en vez de releer la misma
  • Termina un borrador antes de cambiar de modelo, para que la voz se mantenga consistente
  • Lleva notas de qué modelo gana en qué fase para tu propio trabajo

Preguntas frecuentes

¿El siguiente modelo ve toda la conversación?

Sí. Whizi pasa todo el contexto de la conversación por defecto, incluidos tus mensajes, las respuestas de modelos anteriores y los archivos adjuntos, así que el nuevo modelo se une con todo visible. La única salvedad es el presupuesto de entrada por turno, con un tope de 40.000 tokens y proporcionalmente menor en modelos con ventanas de contexto pequeñas: un hilo muy largo se recorta para ajustarse. Una respuesta que parece haber olvidado el inicio de una discusión larga suele estar chocando con ese presupuesto, no con una propiedad del modelo al que cambiaste.

¿Puedo ocultar parte del hilo a un modelo concreto?

Puedes bifurcar el hilo o empezar un chat nuevo solo con el contexto que quieras llevar contigo, lo cual es el enfoque correcto para fragmentos sensibles y también para hilos largos que han acumulado detalles irrelevantes. Empezar de cero con un resumen breve de lo importante suele dar mejores respuestas que arrastrar cuarenta mensajes de historial, ya que el contexto antiguo compite por la atención con la pregunta real.

¿Cambiar de modelo a mitad del borrador cambia el estilo de escritura?

Sí, notablemente, y esa es una razón para terminar un borrador en un mismo modelo antes de cambiar. La consistencia de voz es precisamente lo que difiere entre modelos, así que un traspaso a mitad de un texto largo deja una costura visible. El patrón productivo es redactar todo en un modelo y luego cambiar para la crítica, la comprobación de hechos o una extracción estructurada.

¿Existe un enrutamiento automático de modelos?

Sí, como una única fila del selector llamada Auto. Lee cada mensaje, lo clasifica en uno de seis niveles fijos y responde con el modelo asignado a ese nivel, nunca por encima de lo que permite tu plan. No hay reglas de enrutamiento que escribir: nada en Configuración edita la escala, pondera un nivel o fija Auto a un modelo. Elegir un modelo a mano sigue siendo una decisión por mensaje, y el hábito manual de elegir por fase suele enseñarte más sobre qué modelo se ajusta realmente a tu trabajo.

¿Cambiar de modelo cuenta como mensajes extra?

Cambiar el modelo en el selector no envía nada, así que no se cobra nada hasta tu siguiente mensaje. Cada turno se cobra al costo en créditos del modelo que responde, así que el precio de la siguiente respuesta cambia con el cambio de modelo: un mensaje respondido por un modelo de 1 crédito cuesta 1 crédito y ese mismo mensaje respondido por un modelo de 20 créditos cuesta 20; la escala de créditos enumera el costo de cada modelo. Hacer la misma pregunta a un segundo modelo es un segundo turno cobrado, algo que vale la pena cuando la respuesta importa.