Jak czatować z plikiem PDF online w Whizi

Krótka odpowiedź

Dołącz plik PDF, przeciągając go do pola wiadomości albo klikając ikonę spinacza, a następnie zadaj pytanie zwykłym językiem. Każdy model dostępny w Twoim planie może go odczytać, a między modelami możesz się przełączać przy tym samym pliku bez ponownego przesyłania. Zanim zaufasz odpowiedzi, poproś model o zacytowanie fragmentu, na którym się oparł.

Krótka odpowiedź

Przeciągnij PDF do pola wiadomości albo kliknij ikonę spinacza, żeby go dołączyć, a następnie zadaj pytanie zwykłym językiem. Każdy model dostępny w Twoim planie może go odczytać, a między modelami możesz się przełączać przy tym samym pliku bez ponownego przesyłania.

Zanim zaufasz odpowiedzi, zrób jedną rzecz: poproś model o zacytowanie fragmentu, na którym się oparł. Pewna siebie odpowiedź wzięta z danych treningowych zamiast z Twojego pliku to usterka, która kosztuje ludzi pieniądze, a pytanie lokalizujące wychwytuje ją w jakieś dziesięć sekund. Reszta tej strony to sposób, jak robić to dobrze.

Najpierw upewnij się, że model czyta Twój dokument

Najgroźniejsza usterka w czacie z dokumentem to nie błędna odpowiedź, tylko pewna siebie odpowiedź wzięta z danych treningowych zamiast z Twojego pliku. Zdarza się to najczęściej przy dokumentach przypominających coś powszechnego: standardowa umowa najmu komercyjnego, dobrze znany przepis, szeroko dyskutowana praca naukowa. Model zna gatunek na tyle dobrze, że potrafi wyprodukować wiarygodną odpowiedź bez sięgania do Twojego konkretnego tekstu, a nic w treści odpowiedzi tego nie sygnalizuje.

Jeden nawyk to eliminuje. Zanim zadasz właściwe pytanie, zadaj pytanie lokalizujące.

Zacytuj fragment załączonego dokumentu, który omawia [temat], i podaj stronę lub sekcję, w której się znajduje. Jeśli nie ma go w dokumencie, powiedz to wprost.

Jeśli zwróci prawdziwy cytat, znaczy to, że czyta Twój plik. Jeśli produkuje ogólny parafraz albo nie potrafi znaleźć czegoś, co na pewno tam jest, ekstrakcja się nie powiodła i każda kolejna odpowiedź jest podejrzana. Zajmuje to dziesięć sekund i stanowi różnicę między narzędziem a zagrożeniem.

Przenieś ten nawyk także na właściwe pytania: Zacytuj dokładny tekst, który potwierdza Twoją odpowiedź powinno pojawiać się w każdym promptcie, na którego odpowiedzi będziesz polegać.

Wybór modelu do dokumentu

DokumentModelDlaczego
Raporty 100+ stron, akta, całe zestawy umówGeminiOkno kontekstu na 1 000 000 tokenów, więc dokument jest naprawdę obecny, a nie podzielony na fragmenty
Umowy, polityki, wszystko, gdzie liczą się niuanseClaudeNajlepszy w subtelnościach i w mówieniu, czego dokument nie zawiera
Faktury, formularze, krótkie ustrukturyzowane plikiGPTSzybki i najbardziej niezawodny w ścisłej ekstrakcji do tabel lub JSON
Prace z wykresami, zeskanowane strony, diagramyDowolny model multimodalnyOdczytuje stronę jak obraz tam, gdzie ekstrakcja tekstu zawodzi

Warto wyjaśnić kwestię okna kontekstu. Kiedy dokument przekracza to, co model może pomieścić, musi być przetwarzany we fragmentach, a pytania wymagające całego dokumentu naraz (czy coś tu przeczy klauzuli 14, czy ten termin jest gdziekolwiek zdefiniowany, która z tych trzech sekcji jest niespójna) stają się zawodne. To konkretny powód, żeby przy długich plikach sięgać po model z dużym kontekstem, a nie ogólna preferencja.

Możesz przełączać modele bez ponownego przesyłania, więc czytaj jednym, a wyodrębniaj drugim przy tym samym pliku. Zobacz przełączanie modeli w trakcie rozmowy.

Prompty według typu dokumentu

Umowy i porozumienia

Z załączonej umowy wyodrębnij do tabeli: okres i przedłużenie, okres wypowiedzenia, warunki płatności, limit odpowiedzialności, odszkodowania, prawo właściwe, cesję oraz każdą klauzulę, która przetrwa rozwiązanie umowy. Dla każdej podaj numer klauzuli i zacytuj zdanie operacyjne. Następnie wypisz osobno obowiązki, które spoczywają na nas, a nie na drugiej stronie.

Uzupełnij pytaniem, które naprawdę ma znaczenie: Co w tej umowie jest nietypowe w porównaniu ze standardowymi warunkami dla tego typu kontraktu i czego wyraźnie brakuje? Ryzyko zwykle tkwi w brakach, a to coś, czego wyszukiwanie słów kluczowych nigdy nie znajdzie.

Prace badawcze

Dla załączonej pracy zwróć: pytanie badawcze, projekt badania, próbę i populację, główny wynik, kluczowy rezultat z jego wielkością efektu, wskazane ograniczenia i źródło finansowania. Następnie powiedz mi, które trzy twierdzenia z tej pracy wymagałyby niezależnej weryfikacji, zanim je zacytuję.

Długie raporty i akta

Podsumuj załączony raport w 10 punktach ułożonych według ważności, a nie kolejności w dokumencie. Następnie wypisz: trzy liczby, na których zależałoby decydentowi, z odniesieniami do stron, wszystko, co raport przedstawia jako fakt bez podania źródła, oraz każde miejsce, w którym podsumowanie lub sekcja wykonawcza są niezgodne ze szczegółami dalej w dokumencie.

Ta ostatnia kontrola zaskakująco często wykrywa prawdziwe problemy. Podsumowania wykonawcze pisze się wcześnie i redaguje mniej niż sekcje, które streszczają.

Porównywanie dwóch dokumentów

Porównaj contract-a.pdf i contract-b.pdf klauzula po klauzuli. Zwróć tabelę każdej istotnej różnicy: temat, co mówi A, co mówi B, i co jest korzystniejsze dla nas. Zignoruj różnice formatowania i numeracji. Wypisz osobno wszystko, co jest obecne w jednym, a brakuje w drugim.

Zamiana w coś, czego można użyć

Przepisz ustalenia dla odbiorców kierowniczych w 150 słowach. Zacznij od wymaganej decyzji. Bez żargonu, który nie jest zdefiniowany. Oznacz wszystko, co powinienem zweryfikować przed rozesłaniem tego.

Rozwiązywanie problemów

"Nie widzę dokumentu." Upewnij się, że plik skończył się przesyłać, a następnie odwołaj się do niego wprost po nazwie w wiadomości. Przy bardzo długich wątkach szybsze niż spieranie się z modelem jest ponowne dołączenie pliku albo rozpoczęcie nowego czatu tylko z tym plikiem.

Zeskanowany PDF, zniekształcony lub brakujący tekst. Dokument jest obrazem, więc zwykła ekstrakcja tekstu ma niewiele do odczytania. Whizi wykrywa PDF zdominowany przez obrazy po tym, jak mało tekstu dają jego strony, i przepuszcza go raz przez serwerowy przebieg wizyjny, który zwraca transkrypcję strona po stronie. Dokładność spada przy niskiej rozdzielczości, nietypowych czcionkach, piśmie odręcznym i gęstych tabelach. Ponieważ błędnie odczytana cyfra jest niewidoczna w płynnej odpowiedzi, sprawdzaj każdą liczbę ze zeskanowanego dokumentu z oryginalną stroną.

Tabele wychodzą źle. Tabele w PDF są zwykle fatalnie ustrukturyzowane pod spodem. Poproś najpierw o dosłowne odtworzenie tabeli, sprawdź ją ze stroną, a dopiero potem poproś o analizę. Przy ciężkiej pracy z tabelami model multimodalny odczytujący stronę jak obraz bywa bardziej niezawodny niż ekstrakcja tekstu.

Pominięto coś, o czym wiesz, że tam jest. Zadaj pytanie lokalizujące. Jeśli model nie potrafi zacytować fragmentu, który widzisz, problem leży w ekstrakcji, nie w rozumowaniu. Spróbuj innego modelu albo prześlij tylko odpowiednie strony.

Plik jest za duży. Użyj modelu z dużym kontekstem albo podziel według celu, a nie liczby stron. Przesłanie trzech sekcji, których naprawdę potrzebujesz, bije przesyłanie 400 stron w nadziei.

Odpowiedzi robią się coraz bardziej mgliste w miarę trwania rozmowy. Długie wątki gromadzą kontekst, który konkuruje z dokumentem. Zacznij nowy czat z plikiem i zwięzłym opisem tego, czego potrzebujesz.

Zweryfikuj, zanim zaufasz

Trzy kontrole, w kolejności ważności.

Wymagaj cytatów przy wszystkim istotnym. Zacytowany fragment można sprawdzić w kilka sekund, parafrazy nie da się. Ta jedna praktyka eliminuje większość ryzyka w pracy z dokumentami.

Skrzyżuj z drugim modelem. Zadaj to samo pytanie innemu modelowi przy tym samym pliku. Zgodność jest wymowną poszlaką, niezgodność mówi Ci dokładnie, gdzie patrzeć. Porównanie modeli obok siebie Whizi istnieje właśnie po to.

Zapytaj, co do czego jest niepewny. Której ze swoich powyższych odpowiedzi jesteś najmniej pewny i co w dokumencie jest niejednoznaczne? Modele są niedoskonałe w samoocenie, ale ujawnione przez nie niejasności są zwykle prawdziwymi niejasnościami źródła, co jest przydatną informacją o samym dokumencie.

I stała zasada dla wszystkiego, co niesie konsekwencje, czyli materiałów prawnych, finansowych, medycznych lub zgodności: model znajduje fragment, Ty wydajesz osąd. To asystent czytania, nie doradca, a odpowiedzialność za decyzję podjętą na podstawie jego wyniku spoczywa wyłącznie na Tobie.

Lista kontrolna
  • Zadaj najpierw pytanie lokalizujące, żeby potwierdzić, że model czyta Twój plik
  • Wymagaj dokładnego cytatu przy każdej istotnej odpowiedzi
  • Używaj modelu z dużym kontekstem przy długich dokumentach, żeby nic nie zostało pocięte
  • Pytaj, czego wyraźnie brakuje, tak samo jak o to, co dokument mówi
  • Sprawdzaj liczby ze zeskanowanych dokumentów z oryginalną stroną
  • Odtwarzaj tabele dosłownie i sprawdzaj je, zanim je przeanalizujesz
  • Skrzyżuj każdą ważną rzecz z drugim modelem

Najczęstsze pytania

Jaki jest maksymalny rozmiar PDF?

Każdy przesłany plik jest ograniczony do 10 MB, a jedna wiadomość może nieść do 6 plików. W tych granicach prawdziwym ograniczeniem jest okno kontekstu modelu, a nie limit pliku. Gemini w Whizi ma okno kontekstu na 1 000 000 tokenów, dlatego jest rekomendacją do długich raportów, akt i zestawów wielu umów. Powyżej tego limitu prześlij sekcje, których naprawdę potrzebujesz, zamiast całego dokumentu, ponieważ ukierunkowany kontekst zwykle też daje trafniejszą odpowiedź.

Czy Whizi przechowuje moje pliki PDF?

Przesłane pliki są przechowywane na Twoim koncie, skonfigurowane tak, by wygasać po maksymalnie 30 dniach, i można je usunąć wcześniej w dowolnym momencie. Whizi nie wykorzystuje Twoich promptów, plików, rozmów, transkrypcji głosowych ani wygenerowanej treści do trenowania modeli AI należących do Whizi i nie sprzedaje tej treści jako danych treningowych. Usunięcie pliku nie usuwa tego, co już omówiono na jego temat w rozmowie, więc jeśli dokument jest na tyle wrażliwy, by zasługiwać na usunięcie, usuń też czat.

Czy mogę czatować z wieloma plikami PDF naraz?

Tak, i to właśnie porównywanie dokumentów jest tu najbardziej wartościowe. Prześlij kilka plików do tego samego wątku i odwołuj się do nich po nazwie w promptach, w przeciwnym razie model sam wybiera, na podstawie którego odpowiada, nie mówiąc o tym. Porównywanie umów klauzula po klauzuli, konsolidowanie ustaleń z raportów i znajdowanie sprzeczności między dokumentami wymagają, żeby wszystko było obecne naraz, co jest kolejnym powodem, żeby użyć modelu z dużym kontekstem.

Czy to działa ze zeskanowanymi plikami PDF?

Tak. Whizi wykrywa zeskanowany lub zdominowany przez obrazy PDF po tym, jak mało tekstu dają jego strony, i transkrybuje go strona po stronie przez serwerowy przebieg wizyjny. Dokładność jest dobra przy czystych skanach i spada przy niskiej rozdzielczości, nietypowych czcionkach, piśmie odręcznym i gęstych tabelach. Ponieważ błędnie odczytany znak daje błędną liczbę w skądinąd płynnej odpowiedzi, sprawdzaj każdą liczbę wziętą ze zeskanowanego dokumentu z oryginalną stroną.

Skąd wiem, że odpowiedź naprawdę pochodzi z mojego dokumentu?

Wymagaj cytatu. Poproś model, żeby zacytował dokładny fragment potwierdzający jego odpowiedź, razem ze stroną lub sekcją, i żeby powiedział wprost, jeśli tej informacji nie ma w dokumencie. Odpowiedzi wzięte z danych treningowych zamiast z Twojego pliku to najgroźniejsza usterka w czacie z dokumentem, właśnie dlatego, że są wiarygodne dla powszechnych typów dokumentów, a domaganie się sprawdzalnego cytatu to jedyny niezawodny sposób, żeby dostrzec różnicę.