Krótka odpowiedź
Tak: możesz używać GPT, Claude, Gemini i dowolnego innego modelu w tej samej rozmowie, przełączając się między nimi dla każdej wiadomości w selektorze modeli. Cały wątek przechodzi przez zmianę: twoje wiadomości, odpowiedzi poprzedniego modelu i załączone pliki, więc Claude może skrytykować to, co właśnie napisał GPT, bez konieczności wklejania czegokolwiek ponownie.
Każda tura jest rozliczana według kosztu kredytowego modelu, który na nią odpowiada, a dany model musi być dostępny w twoim planie. Reszta tej strony mówi o tym, kiedy przełączanie się opłaca, a kiedy nie.
Co się dzieje po przełączeniu
Nowy model otrzymuje pełną dotychczasową rozmowę, w tym twoje wiadomości, odpowiedzi poprzedniego modelu i wszystkie załączone pliki. Z jego perspektywy dołącza do dyskusji już w toku, mając wszystko widoczne.
Dlatego to co innego niż kopiowanie tekstu między trzema kartami przeglądarki. Wklejając do nowego narzędzia, przenosisz wynik, ale tracisz rozumowanie, ograniczenia ustalone w ciągu pięciu wiadomości i przesłany dokument. Przełączenie w miejscu zachowuje to wszystko.
Warto znać dwie rzeczy. Nowy model widzi wynik poprzedniego modelu jako część rozmowy, co może skłaniać go do zgadzania się. Gdy chcesz naprawdę niezależnej opinii, powiedz to wprost: Oceń powyższą odpowiedź pod względem jej wartości merytorycznej. Chcę twojej oceny, a nie syntezy tego, co już zostało powiedziane. A budżet wejściowy na turę ma limit 40 000 tokenów, przy czym model z małym oknem kontekstu dostaje proporcjonalnie mniej, więc bardzo długi wątek jest przycinany, aby zmieścił się w wybranym modelu; powyżej tego limitu większe okno kontekstu nie przesyła więcej wątku. Jeśli po przełączeniu odpowiedź wygląda, jakby zapomniała początek dyskusji, zwykle winny jest właśnie budżet kontekstu.
Cztery wzorce warte poznania
1. Routing według fazy. Sposób pracy, do którego dochodzi większość osób. Różne etapy jednego zadania trafiają do różnych modeli.
Struktura w GPT, tekst w Claude, weryfikacja z włączonym wyszukiwaniem w sieci. Sprawdza się przy pisaniu posta, propozycji, specyfikacji czy raportu, bo są to naprawdę trzy różne umiejętności, a nie trzy poziomy trudności tej samej.
2. Druga opinia. Uzyskaj odpowiedź, a następnie przełącz się i poproś nowy model o jej zaatakowanie.
Kolega zaproponował powyższą odpowiedź. Znajdź, co jest w niej nie tak: błędy merytoryczne, pominięte przypadki brzegowe, prostsze podejście albo założenie, które się nie utrzymuje. Jeśli faktycznie jest solidna, powiedz to wprost zamiast wymyślać zastrzeżenia.
Są dwa przydatne wyniki. Albo wychodzi na jaw realna wada, zanim zdążysz na jej podstawie działać, albo drugi model się zgadza mimo nakłaniania go do sprzeciwu, co jest znaczącym potwierdzeniem. Powtarzanie pytania temu samemu modelowi nie daje żadnego z tych efektów, bo modele mają tendencję do zgadzania się same ze sobą.
3. Zmiana ujęcia. Gdy wyjaśnienie nie trafia, przełącz model zamiast czytać je ponownie.
Claude i GPT tłumaczą to samo zagadnienie w naprawdę różny sposób, a to drugie ujęcie często okazuje się tym, które w końcu klika. To najbardziej niedocenianiy powód, by mieć do dyspozycji więcej niż jeden model, a kosztuje jedno kliknięcie.
4. Routing według możliwości. Przełącz się, bo tylko jeden model potrafi wykonać dane zadanie.
Dokument liczący 300 stron trafia do modelu z oknem kontekstu na milion tokenów. Obraz trafia do modelu, który potrafi odczytywać obrazy. Pytanie o wydarzenia z zeszłego tygodnia to jedyny przypadek, który w ogóle nie wymaga przełączenia: wyszukiwanie w sieci w Whizi to przełącznik dla każdej rozmowy z osobna w oknie kompozycji, działa na modelu, którego już używasz, a jego włączenie nic nie kosztuje w kredytach. Reszta to nie preferencja, tylko twardy warunek, i to właśnie w takich sytuacjach subskrypcja jednego modelu po prostu przestaje wystarczać.
Który model do której fazy
Punkt wyjścia, a nie sztywna zasada. Twoje własne zadania powinny go zweryfikować w ciągu tygodnia obserwacji.
| Faza | Model | Dlaczego |
|---|---|---|
| Burza mózgów, struktura, konspekt | GPT | Szybki, ściśle trzyma się briefu, czytelne hierarchie |
| Pisanie tekstu, ton, perswazja | Claude | Najmniej lania wody, utrzymuje głos, najlepszy przy trudnym tonie |
| Research, aktualne fakty, źródła | Dowolny model z włączonym przełącznikiem wyszukiwania | Wyszukiwanie to ustawienie dla danej rozmowy w oknie kompozycji, nie cecha modelu |
| Długie dokumenty, duże korpusy | Gemini | Okno kontekstu 1M tokenów w aktualnych wierszach |
| Ścisłe formaty, tabele, JSON | GPT | Najbardziej niezawodny w trzymaniu się dokładnego schematu |
| Krytyka i red teaming | Cokolwiek, co tego nie napisało | Niezależność to cały sens |
Tabela wymienia trzy rodziny modeli, z którymi większość osób zaczyna, a selektor jest szerszy. Rodziny modeli z otwartymi wagami mają swoje własne strony referencyjne, z kosztem kredytowym za wiadomość i planem, który otwiera każdy wiersz: Llama, Mistral, Kimi i GLM.
Jedna zasada warta zachowania niezależnie od zadania: model, który krytykuje, nigdy nie powinien być modelem, który pisał.
Jak sprawić, by przełączanie się faktycznie opłacało
Przełączanie pomaga najbardziej, gdy powiesz nowemu modelowi, czego od niego oczekujesz. Wskoczenie bez żadnego kontekstu daje ci kontynuację tej samej rozmowy, tylko w nieco innym stylu.
Przekazanie fazy
Mamy już powyższy konspekt. Napisz tylko sekcję 2. Użyj dowodów wymienionych pod nią. Głos: [wklej próbkę]. Nie powtarzaj mi konspektu.
Proszenie o niezależność
Zignoruj ustalone wyżej ramy i odpowiedz na to od nowa: [powtórz pytanie]. Chcę naprawdę niezależnego ujęcia, a nie dopracowania tego, co już tu jest.
Całkowita zmiana zadania
Przestań pisać. Przejdź do recenzowania. Oto kryterium: [podaj je]. Zgłaszaj tylko problemy, nie przepisuj.
Jeszcze jeden nawyk: gdy przełączenie daje wyraźnie lepszy wynik, zanotuj który model i która faza. Po kilku tygodniach będziesz mieć mapę routingu specyficzną dla twojej pracy, a nie dla benchmarku, i taka mapa jest warta więcej niż jakiekolwiek publikowane porównanie.
Kiedy nie przełączać
Przełączanie jest tanie, ale nie darmowe, i są sytuacje, w których pogarsza sprawę.
- W środku szkicu, ze względu na styl. Zmiana modelu w połowie długiego tekstu daje widoczny szew, bo spójność głosu to dokładnie to, co zmienia się między modelami. Dokończ szkic, a dopiero potem przełącz się do krytyki.
- Gdy nie zdefiniowano zadania. Przełączenie nie naprawia niejasnego promptu. Jeśli pierwsza odpowiedź nie pomogła, bo pytanie było niejasne, inny model da ci inną, równie nieprzydatną odpowiedź.
- Aby znaleźć zgodę. Zmienianie modeli, aż jeden powie ci to, co chcesz usłyszeć, to sposób na wybielenie decyzji, którą już podjąłeś. Jeśli dwa z trzech się nie zgadzają, to właśnie jest wynik.
- W bardzo długim wątku, przechodząc do modelu z mniejszym kontekstem. Jeśli wczesny kontekst ma znaczenie, a wątek jest ogromny, zostań przy modelu z dużym kontekstem albo najpierw podsumuj wątek i zacznij od nowa.
Aby uruchomić dwa modele na tym samym prompcie jednocześnie, a nie kolejno, zobacz porównywanie modeli obok siebie.
- Przypisz model do każdej fazy zadania, zanim zaczniesz
- Powiedz nowemu modelowi, jakie zadanie przejmuje, zamiast po prostu kontynuować
- Poproś wprost o niezależność, gdy chcesz prawdziwej drugiej opinii
- Nigdy nie pozwól, by model, który coś napisał, był też tym, który to krytykuje
- Przełącz model, gdy wyjaśnienie nie trafia, zamiast czytać to samo ponownie
- Dokończ szkic przed przełączeniem, żeby styl pozostał spójny
- Prowadź notatki o tym, który model wygrywa w której fazie w twojej pracy
Najczęstsze pytania
Czy kolejny model widzi całą rozmowę?
Tak. Whizi domyślnie przekazuje dalej pełny kontekst rozmowy, w tym twoje wiadomości, wcześniejsze odpowiedzi modeli i załączone pliki, więc nowy model dołącza z pełną widocznością. Jedynym zastrzeżeniem jest budżet wejściowy na turę, który ma limit 40 000 tokenów i jest proporcjonalnie mniejszy przy modelach z małym oknem kontekstu: bardzo długi wątek zostaje przycięty, by się zmieścić. Odpowiedź, która wygląda, jakby zapomniała początek długiej dyskusji, zwykle napotyka właśnie ten limit, a nie jest cechą modelu, na który się przełączyłeś.
Czy mogę ukryć część wątku przed konkretnym modelem?
Możesz rozgałęzić wątek albo zacząć nowy czat tylko z tym kontekstem, który chcesz przenieść, co jest właściwym podejściem przy wrażliwych fragmentach, a także przy długich wątkach, w których nazbierało się nieistotnych szczegółów. Rozpoczęcie od czystego miejsca z krótkim podsumowaniem tego, co ważne, często daje lepsze odpowiedzi niż przenoszenie czterdziestu wiadomości historii, ponieważ starszy kontekst konkuruje o uwagę z właściwym pytaniem.
Czy przełączenie modelu w połowie szkicu zmieni styl pisania?
Tak, wyraźnie, i to jest powód, by dokończyć szkic w jednym modelu przed przełączeniem. Spójność głosu to dokładnie to, co różni się między modelami, więc przekazanie w połowie długiego tekstu zostawia widoczny szew. Produktywny wzorzec to napisanie całego szkicu w jednym modelu, a potem przełączenie się do krytyki, sprawdzenia faktów lub ustrukturyzowanej ekstrakcji.
Czy istnieje automatyczny routing modeli?
Tak, jako pojedynczy wiersz selektora o nazwie Auto. Odczytuje każdą wiadomość, przypisuje ją do jednego z sześciu ustalonych poziomów i odpowiada modelem przypisanym do tego poziomu, nigdy powyżej tego, co otwiera twój plan. Nie ma żadnych reguł routingu do napisania: nic w Ustawieniach nie edytuje tej drabinki, nie waży poziomu ani nie przypina Auto do konkretnego modelu. Ręczne wybieranie modelu pozostaje decyzją podejmowaną dla każdej wiadomości, a ten manualny nawyk wyboru według fazy zwykle uczy więcej o tym, który model naprawdę pasuje do twojej pracy.
Czy przełączenie liczy się jako dodatkowa wiadomość?
Zmiana modelu w selektorze niczego nie wysyła, więc nic nie jest naliczane, dopóki nie wyślesz kolejnej wiadomości. Każda tura jest rozliczana według kosztu kredytowego modelu, który na nią odpowiada, więc cena kolejnej odpowiedzi zmienia się wraz z przełączeniem: wiadomość, na którą odpowiada model za 1 kredyt, kosztuje 1 kredyt, a ta sama wiadomość, na którą odpowiada model za 20 kredytów, kosztuje 20; skala kredytów wymienia koszt każdego modelu. Zadanie tego samego pytania drugiemu modelowi to druga płatna tura, co jest warte swojej ceny, gdy odpowiedź ma znaczenie.