La réponse courte
Oui : vous pouvez utiliser GPT, Claude, Gemini et tout autre modèle dans la même conversation, en changeant de modèle à chaque message depuis le sélecteur de modèle. Tout le fil suit le changement : vos messages, les réponses du modèle précédent et vos fichiers joints, si bien que Claude peut critiquer ce que GPT vient d'écrire sans que vous ayez à recopier quoi que ce soit.
Chaque échange est facturé au coût en crédits du modèle qui répond, et ce modèle doit être inclus dans votre forfait. Le reste de cette page explique quand changer de modèle est payant et quand cela ne l'est pas.
Ce qui se passe quand vous changez de modèle
Le nouveau modèle reçoit toute la conversation jusque là, y compris vos messages, les réponses du modèle précédent et tout fichier joint. De son point de vue, il rejoint une discussion déjà en cours, avec tout ce qui est visible.
C'est ce qui distingue cela du fait de copier du texte entre trois onglets de navigateur. Quand vous collez dans un nouvel outil, vous apportez le résultat mais perdez le raisonnement, les contraintes établies sur cinq messages et le document que vous aviez téléversé. Changer de modèle sur place conserve tout cela.
Deux choses valent d'être connues. Le nouveau modèle voit la sortie du modèle précédent comme faisant partie de la conversation, ce qui peut l'orienter vers l'accord. Quand vous voulez un avis réellement indépendant, dites le explicitement : Évalue la réponse ci-dessus sur le fond. Je veux ton propre jugement, pas une synthèse de ce qui a déjà été dit. Et le budget d'entrée par échange plafonne à 40 000 tokens, avec une part proportionnellement plus faible pour un modèle dont la fenêtre de contexte est petite, si bien qu'un très long fil est réduit pour tenir dans le modèle vers lequel vous basculez ; au delà de ce plafond, une fenêtre de contexte plus grande n'envoie pas davantage du fil. Si un changement de modèle produit une réponse qui semble avoir oublié le début de la discussion, le budget de contexte en est généralement la cause.
Les quatre schémas qui valent la peine d'être appris
1. Le routage par phase. Le schéma vers lequel converge la plupart des gens. Différentes étapes d'une même tâche vont à différents modèles.
Structure dans GPT, prose dans Claude, vérification avec la recherche web activée. Cela s'applique à la rédaction d'un article, d'une proposition, d'un cahier des charges ou d'un rapport, et cela fonctionne parce qu'il s'agit vraiment de trois compétences différentes plutôt que de trois niveaux de difficulté de la même compétence.
2. Le second avis. Obtenez une réponse, puis changez de modèle et demandez au nouveau de l'attaquer.
Un collègue a proposé la réponse ci-dessus. Trouve ce qui ne va pas : erreurs factuelles, cas limites manqués, approche plus simple, ou hypothèse qui ne tient pas. Si elle est réellement solide, dis le clairement plutôt que d'inventer des objections.
Deux résultats utiles. Soit une vraie faille apparaît avant que vous n'agissiez, soit le second modèle est d'accord malgré la consigne de contester, ce qui constitue une confirmation significative. Itérer avec le même modèle ne produit ni l'un ni l'autre, car les modèles ont tendance à être d'accord avec eux mêmes.
3. Le recadrage. Quand une explication ne passe pas, changez de modèle plutôt que de relire.
Claude et GPT expliquent le même concept avec des angles réellement différents, et le second angle est souvent celui qui fait tilt. C'est la raison la plus sous-estimée d'avoir plusieurs modèles à disposition, et cela coûte un clic.
4. Le routage par capacité. Changez de modèle parce que seul un modèle peut faire la tâche.
Un document de 300 pages va à un modèle avec une fenêtre de contexte d'un million de tokens. Une image va à un modèle capable de lire des images. Une question sur la semaine dernière est le seul cas qui ne demande aucun changement : la recherche web dans Whizi est un interrupteur par conversation dans la zone de saisie, elle fonctionne avec le modèle déjà utilisé, et l'activer ne coûte rien en crédits. Le reste n'est pas une préférence, c'est une contrainte stricte, et c'est le cas où un abonnement à un seul modèle atteint simplement sa limite.
Quel modèle pour quelle phase
Un point de départ plutôt qu'une règle. Vos propres tâches devraient la remplacer en une semaine d'attention.
| Phase | Modèle | Pourquoi |
|---|---|---|
| Brainstorming, structure, plan | GPT | Rapide, suit une consigne à la lettre, hiérarchies claires |
| Rédaction, ton, persuasion | Claude | Le moins de remplissage, tient une voix, meilleur sur les tons difficiles |
| Recherche, faits récents, sources | N'importe quel modèle, avec la recherche web activée | La recherche est un réglage par conversation dans la zone de saisie, pas une propriété du modèle |
| Longs documents, gros corpus | Gemini | Fenêtre de contexte d'1 M de tokens sur les gammes actuelles |
| Formats stricts, tableaux, JSON | GPT | Le plus fiable pour respecter un schéma exact |
| Critique et jeu du contradicteur | N'importe quel modèle qui ne l'a pas écrit | L'indépendance est tout l'intérêt |
Le tableau nomme les trois familles avec lesquelles la plupart des gens arrivent, et le sélecteur va bien plus loin. Les familles à poids ouverts ont chacune leur propre page de référence, avec le coût en crédits par message et le forfait qui ouvre chaque ligne : Llama, Mistral, Kimi et GLM.
La seule règle qui vaut la peine d'être retenue quelle que soit la tâche : le modèle qui critique ne doit jamais être celui qui a rédigé.
Faire en sorte que le changement soit vraiment payant
Changer de modèle aide le plus quand vous dites au nouveau modèle ce que vous attendez de lui. Arriver sans cadrage vous donne une continuation de la même conversation avec une voix légèrement différente.
Passer le relais sur une phase
Nous avons maintenant le plan ci-dessus. Rédige uniquement la section 2. Utilise les éléments listés dessous. Voix : [coller un exemple]. Ne reformule pas le plan.
Demander l'indépendance
Ignore le cadrage établi ci-dessus et réponds à cela depuis zéro : [reformuler la question]. Je veux un avis réellement indépendant, pas un simple ajustement de ce qui existe déjà.
Changer complètement de tâche
Arrête de rédiger. Passe à la relecture. Voici le critère : [l'énoncer]. Rapporte uniquement les problèmes, ne réécris rien.
Une habitude supplémentaire : quand un changement produit quelque chose de nettement meilleur, notez quel modèle et quelle phase. Après quelques semaines, vous aurez une carte de routage propre à votre travail plutôt qu'à un benchmark, et cette carte vaut plus que n'importe quelle comparaison publiée.
Quand ne pas changer de modèle
Changer de modèle est peu coûteux mais pas gratuit, et certains cas rendent les choses pires.
- En plein brouillon, pour le style. Changer de modèle à mi-parcours d'un texte long crée une couture visible, car la cohérence de la voix est précisément ce qui varie entre les modèles. Terminez le brouillon, puis changez de modèle pour la critique.
- Quand la tâche n'est pas définie. Changer de modèle ne corrige pas un prompt vague. Si la première réponse n'était pas utile parce que la question n'était pas claire, un autre modèle donne une autre réponse tout aussi peu utile.
- Pour trouver un accord. Enchaîner les modèles jusqu'à ce que l'un vous dise ce que vous voulez entendre revient à blanchir une décision déjà prise. Si deux modèles sur trois sont en désaccord, c'est cela le résultat.
- Sur un très long fil, vers un modèle à plus petit contexte. Si le contexte du début compte et que le fil est énorme, restez avec le modèle à grand contexte ou résumez le fil d'abord et recommencez à neuf.
Pour faire tourner deux modèles sur le même prompt simultanément plutôt que successivement, voir comparer des modèles côte à côte.
- Assignez un modèle à chaque phase de la tâche avant de commencer
- Dites au nouveau modèle quelle tâche il reprend, plutôt que de simplement continuer
- Demandez explicitement l'indépendance quand vous voulez un vrai second avis
- Ne laissez jamais le modèle qui a rédigé être aussi celui qui critique
- Changez de modèle quand une explication ne passe pas, plutôt que de relire la même
- Terminez un brouillon avant de changer de modèle, pour garder une voix cohérente
- Notez quel modèle gagne sur quelle phase pour votre propre travail
Questions fréquentes
Le modèle suivant voit-il toute la conversation ?
Oui. Whizi transmet par défaut tout le contexte de la conversation, y compris vos messages, les réponses des modèles précédents et les fichiers joints, si bien que le nouveau modèle rejoint la discussion avec tout visible. La seule réserve est le budget d'entrée par échange, qui plafonne à 40 000 tokens et est proportionnellement plus faible sur les modèles à petite fenêtre de contexte : un très long fil est réduit pour tenir dedans. Une réponse qui semble avoir oublié le début d'une longue discussion se heurte généralement à ce budget, pas à une propriété du modèle vers lequel vous êtes passé.
Puis-je cacher une partie du fil à un modèle précis ?
Vous pouvez scinder le fil ou démarrer une nouvelle discussion en ne conservant que le contexte que vous voulez transmettre, ce qui est la bonne approche pour les extraits sensibles ainsi que pour les longs fils qui ont accumulé des détails superflus. Repartir de zéro avec un court résumé de l'essentiel produit souvent de meilleures réponses que de transporter quarante messages d'historique, car l'ancien contexte entre en concurrence avec la question actuelle pour l'attention du modèle.
Changer de modèle en plein brouillon modifie-t-il le style d'écriture ?
Oui, nettement, et c'est une raison de terminer un brouillon dans un seul modèle avant de changer. La cohérence de la voix est précisément ce qui diffère entre les modèles, si bien qu'un relais à mi-parcours d'un long texte laisse une couture visible. Le schéma efficace consiste à rédiger entièrement avec un modèle, puis à changer pour la critique, la vérification des faits ou une extraction structurée.
Existe-t-il un routage automatique des modèles ?
Oui, sous la forme d'une seule ligne du sélecteur appelée Auto. Elle lit chaque message, le classe dans l'un des six paliers fixes, et répond avec le modèle attaché à ce palier, jamais au-dessus de ce que votre forfait permet d'ouvrir. Il n'y a aucune règle de routage à écrire : rien dans les Paramètres ne modifie l'échelle, ne pondère un palier ou n'épingle Auto à un modèle. Choisir un modèle à la main reste une décision par message, et l'habitude manuelle de choisir selon la phase tend à mieux vous apprendre quel modèle convient réellement à votre travail.
Changer de modèle compte-t-il comme des messages supplémentaires ?
Changer de modèle dans le sélecteur n'envoie rien, donc rien n'est facturé avant votre prochain message. Chaque échange est facturé au coût en crédits du modèle qui répond, donc le prix de la prochaine réponse change avec le changement de modèle : un message répondu par un modèle à 1 crédit coûte 1 crédit et le même message répondu par un modèle à 20 crédits en coûte 20 ; l'échelle des crédits liste le coût de chaque modèle. Poser la même question à un second modèle est un deuxième échange facturé, ce qui en vaut la peine quand la réponse compte.