Jämför AI-modeller och byt mellan dem mitt i chatten i Whizi

Snabbt svar

Ja. Du kan byta mellan GPT, Claude, Gemini och andra modeller inuti en och samma Whizi-konversation, och ändra vilken modell som svarar per meddelande via väljaren. Hela tråden följer med: dina meddelanden, den tidigare modellens svar och dina bifogade filer. Varje tur debiteras enligt den svarande modellens kreditkostnad.

Det korta svaret

Ja: du kan använda GPT, Claude, Gemini och andra modeller i samma konversation och byta mellan dem per meddelande via modellväljaren. Hela tråden följer med genom bytet: dina meddelanden, den tidigare modellens svar och dina bifogade filer, så att Claude kan granska vad GPT just skrev utan att du klistrar in något igen.

Varje tur debiteras enligt den svarande modellens kreditkostnad, och modellen måste ingå i ditt paket. Resten av sidan handlar om när ett byte lönar sig och när det inte gör det.

Vad som händer när du byter

Den nya modellen får hela den befintliga konversationen, inklusive dina meddelanden, den tidigare modellens svar och eventuella bifogade filer. Ur dess perspektiv ansluter den till en diskussion som redan pågår, med allt synligt.

Det är därför detta skiljer sig från att klistra in text mellan tre webbläsarflikar. När du klistrar in i ett nytt verktyg tar du med resultatet men tappar resonemanget, de begränsningar du etablerat över fem meddelanden och dokumentet du laddade upp. Att byta på plats behåller allt.

Två saker är värda att veta. Den nya modellen ser den tidigare modellens svar som en del av konversationen, vilket kan förankra den mot att hålla med. När du vill ha en genuint oberoende åsikt, säg det uttryckligen: Bedöm svaret ovan utifrån dess egna meriter. Jag vill ha din egen bedömning, inte en sammanfattning av vad som redan sagts. Och budgeten för inmatning per tur toppar på 40 000 token, där en modell med litet kontextfönster får proportionellt mindre, så en mycket lång tråd trimmas för att passa den modell du byter till. Bortom den gränsen skickar ett större kontextfönster inte mer av tråden. Om ett byte ger ett svar som verkar ha glömt den tidiga delen av diskussionen beror det oftast på kontextbudgeten.

De fyra mönstren som är värda att lära sig

1. Fasrouting. Det arbetssätt som de flesta landar i. Olika faser av en uppgift går till olika modeller.

Struktur i GPT, prosa i Claude, kontroll med webbsökning på. Det passar för att skriva ett inlägg, ett förslag, en spec eller en rapport, och det fungerar eftersom dessa verkligen är tre olika färdigheter snarare än tre svårighetsgrader av samma.

2. Den andra åsikten. Få ett svar, byt sedan och be den nya modellen att angripa det.

En kollega föreslog svaret ovan. Hitta vad som är fel med det: sakfel, missade specialfall, en enklare metod eller ett antagande som inte håller. Om det faktiskt är hållbart, säg det rakt ut i stället för att uppfinna invändningar.

Två användbara utfall. Antingen dyker en verklig brist upp innan du agerar på svaret, eller den andra modellen håller med trots att den pressats att vara oenig, vilket är en meningsfull bekräftelse. Att iterera med samma modell ger ingen av dem, eftersom modeller tenderar att hålla med sig själva.

3. Omformuleringen. När en förklaring inte landar, byt i stället för att läsa om.

Claude och GPT förklarar samma koncept med genuint olika infallsvinklar, och den andra infallsvinkeln är ofta den som klickar till. Det är det enskilt mest underskattade skälet till att ha mer än en modell tillgänglig, och det kostar ett klick.

4. Förmågerouting. Byt eftersom bara en modell klarar uppgiften.

Ett dokument på 300 sidor går till en modell med ett kontextfönster på en miljon token. En bild går till en modell som kan läsa bilder. En fråga om förra veckan är det enda fallet som inte kräver något byte alls: webbsökning i Whizi är en inställning per konversation i skrivfältet, den körs på modellen du redan använder, och att slå på den kostar inget i krediter. Resten är inte en preferens, det är en hård begränsning, och det är fallet där en prenumeration med en enda modell helt enkelt tar slut.

Vilken modell för vilken fas

En utgångspunkt snarare än en regel. Dina egna uppgifter bör överstyra den inom en veckas uppmärksamhet.

FasModellVarför
Brainstorm, struktur, dispositionGPTSnabb, följer en brief exakt, rena hierarkier
Skriva utkast, ton, övertalningClaudeMinst utfyllnad, håller en röst, bäst på svår ton
Research, aktuella fakta, källorVilken modell som helst, med webbsökning påSökning är en inställning per konversation i skrivfältet, inte en modellegenskap
Långa dokument, stora korpusarGeminiKontextfönster på 1M token på de nuvarande raderna
Strikta format, tabeller, JSONGPTMest tillförlitlig när det gäller att följa ett exakt schema
Kritik och red teamingVad som helst som inte skrev detOberoende är hela poängen

Tabellen namnger de tre familjer flest kommer med, och väljaren är bredare än det. De öppna vikt-familjerna har varsin egen referenssida, med kreditkostnaden per meddelande och paketet som öppnar varje rad: Llama, Mistral, Kimi och GLM.

Den enda regeln värd att hålla oavsett uppgift: modellen som kritiserar bör aldrig vara modellen som skrev utkastet.

Att få bytet att faktiskt löna sig

Att byta hjälper mest när du talar om för den nya modellen vad du vill ha av den. Att bara hoppa in utan ramverk ger dig en fortsättning på samma konversation i en lite annan röst.

Att lämna över en fas

Nu har vi dispositionen ovan. Skriv bara utkast till avsnitt 2. Använd beläggen listade under det. Röst: [klistra in exempel]. Återge inte dispositionen till mig.

Att be om oberoende

Bortse från ramverket etablerat ovan och besvara detta från grunden: [omformulera frågan]. Jag vill ha en genuint oberoende ståndpunkt, inte en förfining av det som redan finns här.

Att byta uppgiften helt

Sluta skriva utkast. Byt till att granska. Här är kriteriet: [ange det]. Rapportera bara problem, skriv inte om.

En ytterligare vana: när ett byte ger något märkbart bättre, notera vilken modell och vilken fas. Efter ett par veckor har du en routingkarta som är specifik för ditt arbete snarare än för ett benchmark, och den kartan är värd mer än någon publicerad jämförelse.

När du inte ska byta

Att byta är billigt men inte fritt, och det finns fall där det gör saker värre.

  • Mitt i utkastet, för stilen. Att byta modell halvvägs genom en lång text ger en synlig söm, eftersom röstkonsekvens är precis det som skiljer mellan modeller. Slutför utkastet, byt sedan för granskningen.
  • När du inte har definierat uppgiften. Att byta löser inte en vag prompt. Om det första svaret var oanvändbart eftersom frågan var otydlig ger en annan modell dig ett annat oanvändbart svar.
  • För att hitta enighet. Att cykla tills en modell säger vad du vill höra är ett sätt att tvätta ett beslut du redan tagit. Om två av tre inte håller med är det fyndet.
  • På en mycket lång tråd, in i en modell med mindre kontext. Om den tidiga kontexten spelar roll och tråden är enorm, håll dig antingen till modellen med stor kontext eller sammanfatta tråden och börja om.

För att köra två modeller på samma prompt samtidigt snarare än sekventiellt, se jämför modeller sida vid sida.

Checklista
  • Tilldela en modell till varje fas av uppgiften innan du börjar
  • Berätta för den nya modellen vilket jobb den tar över, i stället för att bara fortsätta
  • Be uttryckligen om oberoende när du vill ha en verklig andra åsikt
  • Låt aldrig modellen som skrev utkastet också vara den som kritiserar det
  • Byt när en förklaring inte landar, i stället för att läsa om samma en gång till
  • Slutför ett utkast innan du byter, så att rösten hålls konsekvent
  • Anteckna vilken modell som vinner vilken fas för ditt eget arbete

Vanliga frågor

Ser nästa modell hela konversationen?

Ja. Whizi skickar hela konversationskontexten vidare som standard, inklusive dina meddelanden, tidigare modellsvar och bifogade filer, så att den nya modellen ansluter med allt synligt. Den enda brasklappen är budgeten för inmatning per tur, som toppar på 40 000 token och är proportionellt mindre på modeller med litet kontextfönster: en mycket lång tråd trimmas för att passa. Ett svar som verkar ha glömt den tidiga delen av en lång diskussion drabbas oftast av den budgeten, inte av någon egenskap hos modellen du bytte till.

Kan jag dölja en del av tråden för en specifik modell?

Du kan grena tråden eller starta en ny chatt med bara den kontext du vill ta med, vilket är rätt tillvägagångssätt för känsliga utdrag och även för långa trådar som samlat på sig irrelevanta detaljer. Att börja rent med en kort sammanfattning av vad som spelar roll ger ofta bättre svar än att bära med fyrtio meddelanden av historik, eftersom äldre kontext konkurrerar om uppmärksamheten med den faktiska frågan.

Ändrar det skrivstilen om jag byter modell mitt i utkastet?

Ja, märkbart, och det är ett skäl att slutföra ett utkast i en modell innan du byter. Röstkonsekvens är precis det som skiljer mellan modeller, så en överlämning halvvägs genom en lång text lämnar en synlig söm. Det produktiva mönstret är att skriva utkastet helt i en modell och sedan byta för granskningen, faktakontrollen eller en strukturerad extraktion.

Finns det automatisk modellrouting?

Ja, som en enda väljarrad kallad Auto. Den läser varje meddelande, sorterar det i en av sex fasta nivåer och svarar på modellen som är fäst vid den nivån, aldrig över vad ditt paket kan öppna. Det finns inga routingregler att skriva: inget i Inställningar redigerar stegen, viktar en nivå eller fäster Auto vid en modell. Att välja modell för hand är fortfarande ett beslut per meddelande, och vanan att välja per fas för hand tenderar att lära dig mer om vilken modell som faktiskt passar ditt arbete.

Räknas ett byte som extra meddelanden?

Att byta modell i väljaren skickar ingenting, så inget debiteras förrän ditt nästa meddelande. Varje tur debiteras enligt den svarande modellens kreditkostnad, så priset på nästa svar ändras med bytet: ett meddelande besvarat av en modell för 1 kredit kostar 1 kredit och samma meddelande besvarat av en modell för 20 krediter kostar 20; kreditskalan listar varje modells kostnad. Att ställa samma fråga till en andra modell är en andra debiterad tur, vilket är värt det när svaret spelar roll.