Stručná odpověď
Ano: v rámci jedné konverzace můžete použít GPT, Claude, Gemini i jakýkoli jiný model a přepínat mezi nimi u každé zprávy z výběru modelu. Celé vlákno se při přepnutí přenese: vaše zprávy, odpovědi předchozího modelu i připojené soubory, takže Claude může kritizovat to, co právě napsal GPT, aniž byste cokoli znovu vkládali.
Každé kolo se účtuje podle kreditní ceny modelu, který na něj odpoví, a model musí být zahrnutý ve vašem plánu. Zbytek této stránky se věnuje tomu, kdy se přepínání vyplatí a kdy ne.
Co se stane, když přepnete
Nový model dostane celou konverzaci až do té chvíle, včetně vašich zpráv, odpovědí předchozího modelu i všech připojených souborů. Ze svého pohledu se připojuje k diskuzi, která už probíhá, a vidí úplně vše.
Proto je to jiné než kopírování textu mezi třemi kartami prohlížeče. Když vložíte text do nového nástroje, přenesete výstup, ale ztratíte úvahu, omezení, která jste stanovili v pěti předchozích zprávách, i nahraný dokument. Přepnutí na místě si udrží úplně vše.
Stojí za to znát dvě věci. Nový model vidí výstup předchozího modelu jako součást konverzace, což ho může ukotvit směrem k souhlasu. Když chcete opravdu nezávislý pohled, řekněte to explicitně: Zhodnoť odpověď výše na základě jejích kvalit. Chci tvé posouzení, ne syntézu toho, co už bylo řečeno. A rozpočet vstupu na jedno kolo má strop 40 000 tokenů, přičemž model s malým kontextovým oknem z něj dostane proporcionálně méně, takže velmi dlouhé vlákno se zkrátí, aby se vešlo do modelu, na který přepnete; nad tímto stropem větší kontextové okno neposílá víc z vlákna. Pokud přepnutí vede k odpovědi, která zapomněla začátek diskuze, obvykle za to může rozpočet kontextu.
Čtyři vzory, které se vyplatí znát
1. Rozdělení podle fáze. Postup, ke kterému se většina lidí propracuje. Různé fáze jednoho úkolu jdou k různým modelům.
Struktura v GPT, text v Claude, kontrola se zapnutým vyhledáváním na webu. Platí to pro psaní příspěvku, návrhu, specifikace i reportu a funguje to proto, že jde skutečně o tři odlišné dovednosti, ne o tři úrovně obtížnosti stejné dovednosti.
2. Druhý názor. Získejte odpověď, pak přepněte a požádejte nový model, aby ji napadl.
Kolega navrhl odpověď výše. Najdi, co je na ní špatně: faktické chyby, opomenuté hraniční případy, jednodušší přístup nebo předpoklad, který neplatí. Pokud je skutečně v pořádku, řekni to jasně, a nevymýšlej si námitky.
Vzejdou z toho dva užitečné výsledky. Buď vyplyne skutečná chyba dřív, než na jejím základě jednáte, nebo druhý model souhlasí i přesto, že byl vyzván k nesouhlasu, což je smysluplné potvrzení. Opakování se stejným modelem nedá ani jedno, protože modely mají tendenci souhlasit se sebou samými.
3. Přerámování. Když vysvětlení nesedí, přepněte model, místo abyste text znovu četli.
Claude a GPT vysvětlují stejný pojem opravdu odlišným způsobem a druhé rámování je často to, které nakonec zapadne. Toto je jediný nejvíc podceňovaný důvod, proč mít k dispozici víc než jeden model, a stojí to jedno kliknutí.
4. Přepínání podle schopností. Přepněte, protože danou věc umí jen jeden model.
Dokument o 300 stranách patří k modelu s kontextovým oknem o milionu tokenů. Obrázek patří k modelu, který umí číst obrázky. Dotaz na minulý týden je jediný případ, kdy nepotřebujete přepínat vůbec: vyhledávání na webu ve Whizi je přepínač pro danou konverzaci přímo v okně pro psaní zprávy, běží na modelu, který už používáte, a jeho zapnutí nestojí žádné kredity. Zbytek není otázka preference, je to pevné omezení, a přesně v takovém případě předplatné na jeden model prostě nestačí.
Který model pro kterou fázi
Výchozí bod, ne pravidlo. Vaše vlastní úkoly by ho měly během týdne pozorného sledování přepsat.
| Fáze | Model | Proč |
|---|---|---|
| Brainstorming, struktura, osnova | GPT | Rychlý, přesně dodržuje zadání, čisté hierarchie |
| Návrh textu, tón, persvaze | Claude | Nejméně vycpávek, udrží styl, nejlepší na obtížný tón |
| Research, aktuální fakta, zdroje | Libovolný model se zapnutým vyhledáváním na webu | Vyhledávání je nastavení pro danou konverzaci v okně pro psaní zprávy, ne vlastnost modelu |
| Dlouhé dokumenty, velké korpusy | Gemini | Kontextové okno 1M tokenů u aktuálních řad |
| Přesné formáty, tabulky, JSON | GPT | Nejspolehlivější při dodržení přesného schématu |
| Kritika a red teaming | Cokoli, co to nenapsalo | Nezávislost je hlavní smysl |
Tabulka jmenuje tři rodiny modelů, se kterými většina lidí začíná, a výběr modelů je širší. Rodiny modelů s otevřenými vahami mají každá svou vlastní referenční stránku, s kreditní cenou za zprávu a plánem, který otevírá daný řádek: Llama, Mistral, Kimi a GLM.
Jedno pravidlo, které stojí za to dodržovat bez ohledu na úkol: model, který kritizuje, by nikdy neměl být tím, který text napsal.
Jak přepínání skutečně zúročit
Přepínání pomůže nejvíc, když novému modelu řeknete, co od něj chcete. Když ho jen zapojíte bez rámování, dostanete pokračování stejné konverzace, jen v trochu jiném hlase.
Předání fáze
Máme výše uvedenou osnovu. Napiš návrh pouze pro sekci 2. Použij důkazy uvedené pod ní. Hlas: [vložte vzorek]. Osnovu mi zpět neopakuj.
Žádost o nezávislost
Ignoruj rámování stanovené výše a odpověz na toto od začátku: [zopakujte otázku]. Chci opravdu nezávislý pohled, ne zpřesnění toho, co už tu je.
Úplná změna úkolu
Přestaň psát návrh. Přepni na revizi. Tady je kritérium: [uveďte ho]. Nahlas jen problémy, nepřepisuj text.
Ještě jeden zvyk navíc: když přepnutí přinese znatelně lepší výsledek, poznamenejte si, který model a která fáze. Po několika týdnech budete mít mapu přepínání, která je specifická pro vaši práci, ne pro nějaký benchmark, a taková mapa má větší hodnotu než jakékoli publikované srovnání.
Kdy nepřepínat
Přepínání je levné, ale ne zadarmo, a existují případy, kdy věci jen zhorší.
- Uprostřed návrhu, kvůli stylu. Změna modelu v polovině delšího textu vytvoří viditelný šev, protože konzistence hlasu je přesně to, co se mezi modely liší. Dokončete návrh a pak přepněte na kritiku.
- Když jste úkol nedefinovali. Přepnutí nespraví vágní prompt. Pokud první odpověď nebyla užitečná, protože otázka nebyla jasná, jiný model vám dá jinou neužitečnou odpověď.
- Ve snaze najít shodu. Opakované zkoušení, dokud vám model neřekne, co chcete slyšet, je způsob, jak si legitimizovat rozhodnutí, které jste už udělali. Pokud dva ze tří nesouhlasí, to je ten skutečný závěr.
- Ve velmi dlouhém vlákně, do modelu s menším kontextem. Pokud je počáteční kontext důležitý a vlákno je obrovské, buď zůstaňte u modelu s velkým kontextem, nebo vlákno nejdřív shrňte a začněte znovu.
Pro spuštění dvou modelů na stejném promptu současně, ne postupně, viz porovnání modelů vedle sebe.
- Přiřaďte model ke každé fázi úkolu ještě před začátkem
- Řekněte novému modelu, jakou práci teď převzal, místo aby jen pokračoval
- Když chcete skutečný druhý názor, o nezávislost si explicitně požádejte
- Nikdy nedovolte, aby model, který text napsal, byl i tím, kdo ho kritizuje
- Přepněte model, když vysvětlení nesedí, místo opakovaného čtení téhož
- Dokončete návrh před přepnutím, aby zůstal hlas konzistentní
- Vedle si poznámky, který model vyhrává v které fázi pro vaši vlastní práci
Časté dotazy
Vidí další model celou konverzaci?
Ano. Whizi standardně předává celý kontext konverzace dál, včetně vašich zpráv, odpovědí předchozích modelů a připojených souborů, takže nový model se připojuje s plným přehledem. Jediné upozornění je rozpočet vstupu na jedno kolo, který má strop 40 000 tokenů a je proporcionálně menší u modelů s malým kontextovým oknem: velmi dlouhé vlákno se zkrátí, aby se vešlo. Odpověď, která vypadá, že zapomněla začátek dlouhé diskuze, obvykle naráží na tento rozpočet, ne na vlastnost modelu, na který jste přepnuli.
Můžu před konkrétním modelem skrýt část vlákna?
Vlákno můžete rozdělit nebo začít nový chat pouze s kontextem, který chcete přenést, což je správný přístup u citlivých úseků a také u dlouhých vláken, ve kterých se nahromadily nepodstatné detaily. Začít znovu s krátkým shrnutím toho, co je důležité, často přináší lepší odpovědi než přenášet čtyřicet zpráv historie, protože starší kontext soupeří o pozornost s tou skutečnou otázkou.
Změní přepnutí modelu uprostřed návrhu styl psaní?
Ano, výrazně, a proto je dobré dokončit návrh v jednom modelu ještě před přepnutím. Konzistence hlasu je přesně to, co se mezi modely liší, takže předání v polovině delšího textu zanechá viditelný šev. Osvědčený postup je napsat celý návrh v jednom modelu a pak přepnout na kritiku, faktickou kontrolu nebo strukturovanou extrakci.
Existuje automatické přepínání modelů?
Ano, jako jediný řádek výběru s názvem Auto. Přečte každou zprávu, zařadí ji do jednoho ze šesti pevných stupňů a odpoví na modelu přiřazeném k tomuto stupni, nikdy výš, než co dovolí váš plán. Žádná pravidla směrování si nepíšete: nic v Nastavení nemění žebříček, neváží stupeň ani nepřipoutá Auto k jednomu modelu. Ruční výběr modelu zůstává rozhodnutím u každé zprávy a ruční volba podle fáze vás obvykle naučí víc o tom, který model se vaší práci skutečně hodí.
Počítá se přepnutí jako další zpráva?
Změna modelu ve výběru nic neposílá, takže se nic neúčtuje, dokud nenapíšete další zprávu. Každé kolo se účtuje podle kreditní ceny modelu, který na něj odpoví, takže cena další odpovědi se s přepnutím mění: zprávu, na kterou odpoví model za 1 kredit, stojí 1 kredit, a tu samou zprávu, na kterou odpoví model za 20 kreditů, stojí 20; kreditní stupnice uvádí cenu každého modelu. Zeptat se druhého modelu na stejnou otázku je druhé zúčtované kolo, které se vyplatí, když na odpovědi záleží.