Hoe je halverwege een gesprek van AI model wisselt in Whizi

Kort antwoord

Ja. Je kunt binnen één Whizi gesprek wisselen tussen GPT, Claude, Gemini en elk ander model, waarbij je per bericht het actieve model kiest via de kiezer. De hele thread gaat mee: je berichten, de antwoorden van het vorige model en je bijgevoegde bestanden. Elke beurt wordt afgerekend tegen de creditkosten van het model dat antwoordt.

Het korte antwoord

Ja: je kunt GPT, Claude, Gemini en elk ander model in hetzelfde gesprek gebruiken, en per bericht wisselen via de modelkiezer. De hele thread gaat mee over de wissel heen: je berichten, de antwoorden van het vorige model en je bijgevoegde bestanden, zodat Claude kritiek kan geven op wat GPT net schreef zonder dat je iets opnieuw hoeft te plakken.

Elke beurt wordt afgerekend tegen de creditkosten van het model dat antwoordt, en het model moet in je abonnement zitten. De rest van deze pagina gaat over wanneer wisselen loont en wanneer niet.

Wat er gebeurt als je wisselt

Het nieuwe model ontvangt het volledige gesprek tot dan toe, inclusief je berichten, de antwoorden van het vorige model en eventuele bijgevoegde bestanden. Vanuit zijn perspectief sluit het aan bij een discussie die al gaande is, met alles zichtbaar.

Daarom verschilt dit van tekst kopiëren tussen drie browsertabs. Als je in een nieuwe tool plakt, neem je de uitvoer mee maar verlies je de redenering, de beperkingen die je over vijf berichten hebt opgebouwd, en het document dat je hebt geüpload. Wisselen ter plekke behoudt dat allemaal.

Twee dingen zijn goed om te weten. Het nieuwe model ziet de uitvoer van het vorige model als onderdeel van het gesprek, wat het kan verankeren richting instemming. Wil je een echt onafhankelijke blik, zeg dat dan expliciet: Beoordeel het antwoord hierboven op zijn merites. Ik wil jouw beoordeling, geen synthese van wat al gezegd is. En het invoerbudget per beurt ligt maximaal op 40.000 tokens, waarbij een model met een klein contextvenster proportioneel minder krijgt, dus een zeer lange thread wordt ingekort om te passen bij het model waarnaar je wisselt; boven die grens stuurt een groter contextvenster niet meer van de thread mee. Als een wissel een antwoord oplevert dat het begin van de discussie lijkt te zijn vergeten, is het contextbudget meestal de reden.

De vier patronen die de moeite waard zijn

1. Fasering. Het workflow waar de meeste mensen op uitkomen. Verschillende fasen van één taak gaan naar verschillende modellen.

Structuur in GPT, proza in Claude, verificatie met websearch aan. Het geldt voor het schrijven van een post, een voorstel, een spec of een rapport, en het werkt omdat dit echt drie verschillende vaardigheden zijn in plaats van drie moeilijkheidsgraden van dezelfde vaardigheid.

2. De tweede mening. Krijg een antwoord, wissel dan en vraag het nieuwe model het aan te vallen.

Een collega heeft het antwoord hierboven voorgesteld. Zoek wat er fout aan is: feitelijke fouten, gemiste randgevallen, een eenvoudigere aanpak, of een aanname die niet klopt. Als het echt deugt, zeg dat dan gewoon in plaats van bezwaren te verzinnen.

Twee nuttige uitkomsten. Ofwel komt er een echte fout aan het licht voordat je ernaar handelt, ofwel is het tweede model het toch eens ondanks de druk om het oneens te zijn, wat een zinvolle bevestiging is. Herhalen met hetzelfde model levert geen van beide op, omdat modellen de neiging hebben het met zichzelf eens te zijn.

3. De herkadering. Als een uitleg niet aanslaat, wissel dan in plaats van opnieuw te lezen.

Claude en GPT leggen hetzelfde concept uit met echt verschillende invalshoeken, en vaak is de tweede invalshoek degene die het doet klikken. Dit is de meest onderschatte reden om meer dan één model beschikbaar te hebben, en het kost één klik.

4. Routering op basis van vermogen. Wissel omdat alleen één model het kan.

Een document van 300 pagina's gaat naar een model met een contextvenster van een miljoen tokens. Een afbeelding gaat naar een model dat afbeeldingen kan lezen. Een vraag over vorige week is het enige geval waarin helemaal geen wissel nodig is: websearch in Whizi is een toggle per gesprek in het invoerveld, het draait op het model dat je al gebruikt, en het aanzetten kost geen credits. De rest is geen voorkeur, het is een harde beperking, en dat is precies waar een abonnement op één model gewoon ophoudt te volstaan.

Welk model voor welke fase

Een uitgangspunt, geen regel. Je eigen taken zouden dit binnen een week van opletten moeten overrulen.

FaseModelWaarom
Brainstormen, structuur, outlineGPTSnel, volgt een briefing strak, heldere hiërarchieën
Proza schrijven, toon, overtuigingskrachtClaudeMinst vulling, houdt een stem vast, het beste in lastige toon
Onderzoek, recente feiten, bronnenElk model, met de websearch toggle aanSearch is een instelling per gesprek in het invoerveld, geen modeleigenschap
Lange documenten, grote corporaGeminiContextvenster van 1M tokens op de huidige rijen
Strikte formats, tabellen, JSONGPTHet meest betrouwbaar in het volgen van een exact schema
Kritiek en red teamingAlles wat het niet zelf schreefOnafhankelijkheid is het hele punt

De tabel noemt de drie families waarmee de meeste mensen beginnen, en de kiezer is breder dan dat. De families met open gewichten hebben elk een eigen referentiepagina, met de creditkosten per bericht en het abonnement dat elke rij ontgrendelt: Llama, Mistral, Kimi en GLM.

De ene regel die het waard is om vast te houden, ongeacht de taak: het model dat kritiek levert mag nooit het model zijn dat het concept schreef.

De wissel echt laten renderen

Wisselen helpt het meest als je het nieuwe model vertelt wat je ervan wilt. Zomaar instappen zonder kader levert een voortzetting van hetzelfde gesprek op in een iets andere stem.

Een fase overdragen

We hebben nu de outline hierboven. Werk alleen sectie 2 uit. Gebruik het bewijs dat eronder staat. Stem: [plak voorbeeld]. Herhaal de outline niet aan mij.

Vragen om onafhankelijkheid

Negeer het kader dat hierboven is opgezet en beantwoord dit vanaf nul: [herhaal de vraag]. Ik wil een echt onafhankelijke kijk, geen verfijning van wat er al staat.

De taak volledig veranderen

Stop met schrijven. Schakel over naar beoordelen. Dit is het criterium: [noem het]. Rapporteer alleen problemen, herschrijf niet.

Nog een gewoonte die helpt: wanneer een wissel iets merkbaar beters oplevert, noteer dan welk model en welke fase. Na een paar weken heb je een routekaart die specifiek is voor jouw werk in plaats van voor een benchmark, en die kaart is meer waard dan elke gepubliceerde vergelijking.

Wanneer je niet moet wisselen

Wisselen is goedkoop maar niet gratis, en er zijn gevallen waarin het de zaak juist erger maakt.

  • Halverwege een concept, om de stijl. Van model veranderen halverwege een lang stuk levert een zichtbare naad op, omdat consistentie in stem precies is wat verschilt tussen modellen. Maak het concept eerst af, wissel dan pas voor de kritiek.
  • Als je de taak niet hebt gedefinieerd. Wisselen lost een vage prompt niet op. Als het eerste antwoord niet hielp omdat de vraag onduidelijk was, geeft een ander model je een ander niet helpend antwoord.
  • Om instemming te vinden. Doorwisselen tot een model zegt wat je wilt horen is een manier om een beslissing die je al had genomen wit te wassen. Als twee van de drie het oneens zijn, is dat de bevinding.
  • Bij een zeer lange thread, naar een model met een kleiner contextvenster. Als de vroege context ertoe doet en de thread enorm is, blijf dan bij het model met groot contextvenster of vat de thread eerst samen en begin opnieuw.

Voor het gelijktijdig in plaats van na elkaar draaien van twee modellen op dezelfde prompt, zie modellen naast elkaar vergelijken.

Checklist
  • Wijs voor je begint een model toe aan elke fase van de taak
  • Vertel het nieuwe model welke taak het overneemt, in plaats van gewoon door te gaan
  • Vraag expliciet om onafhankelijkheid als je een echte tweede mening wilt
  • Laat het model dat iets schreef nooit ook het model zijn dat het beoordeelt
  • Wissel wanneer een uitleg niet aanslaat, in plaats van dezelfde nog eens te lezen
  • Maak een concept af voordat je wisselt, zodat de stem consistent blijft
  • Houd bij welk model welke fase wint voor je eigen werk

Veelgestelde vragen

Ziet het volgende model het hele gesprek?

Ja. Whizi geeft standaard de volledige gespreekscontext door, inclusief je berichten, eerdere modelantwoorden en bijgevoegde bestanden, zodat het nieuwe model instapt met alles zichtbaar. De enige kanttekening is het invoerbudget per beurt, dat maximaal 40.000 tokens bedraagt en proportioneel kleiner is bij modellen met een klein contextvenster: een zeer lange thread wordt ingekort om te passen. Een antwoord dat het begin van een lange discussie lijkt te zijn vergeten, raakt meestal dat budget, niet een eigenschap van het model waarnaar je bent gewisseld.

Kan ik een deel van de thread verbergen voor een specifiek model?

Je kunt de thread splitsen of een nieuwe chat starten met alleen de context die je wilt meenemen, wat de juiste aanpak is voor gevoelige fragmenten en ook voor lange threads die irrelevante details hebben opgebouwd. Fris beginnen met een korte samenvatting van wat belangrijk is, levert vaak betere antwoorden op dan veertig berichten geschiedenis meenemen, omdat oudere context concurreert om aandacht met de eigenlijke vraag.

Verandert de schrijfstijl als ik halverwege een concept van model wissel?

Ja, merkbaar, en dat is een reden om een concept in één model af te maken voordat je wisselt. Consistentie in stem is precies wat verschilt tussen modellen, dus een overdracht halverwege een lang stuk laat een zichtbare naad achter. Het productieve patroon is volledig schrijven in één model, en dan wisselen voor de kritiek, de feitencheck of een gestructureerde extractie.

Bestaat er automatische modelroutering?

Ja, als één kiezerregel genaamd Auto. Het leest elk bericht, sorteert het in een van zes vaste treden, en beantwoordt op het model dat aan die trede vastzit, nooit hoger dan wat je abonnement kan ontgrendelen. Er zijn geen routeringsregels om te schrijven: niets in Instellingen bewerkt de ladder, weegt een trede, of pint Auto aan een model. Handmatig een model kiezen blijft een beslissing per bericht, en de gewoonte om handmatig per fase te kiezen leert je doorgaans meer over welk model echt bij jouw werk past.

Telt wisselen als extra berichten?

Het model wisselen in de kiezer verstuurt niets, dus er wordt niets in rekening gebracht tot je volgende bericht. Elke beurt wordt afgerekend tegen de creditkosten van het model dat antwoordt, dus de prijs van het volgende antwoord verandert met de wissel: een bericht beantwoord door een model van 1 credit kost 1 credit en hetzelfde bericht beantwoord door een model van 20 credits kost 20; de creditschaal vermeldt de kosten van elk model. Dezelfde vraag aan een tweede model stellen is een tweede in rekening gebrachte beurt, wat de moeite waard is wanneer het antwoord ertoe doet.