Jak chatovat s PDF online ve Whizi (pdf chat ai)

Krátká odpověď

Připojte PDF přetažením do okna zprávy nebo kliknutím na ikonu sponky, poté napište otázku běžným jazykem. Přečíst ho umí libovolný model ve vašem plánu a mezi modely můžete přepínat nad stejným souborem, aniž byste ho nahrávali znovu. Než se na odpověď spolehnete, požádejte model, aby ocitoval pasáž, ze které vycházel.

Stručná odpověď

Přetáhněte PDF do okna zprávy nebo klikněte na ikonu sponky a připojte ho, poté napište otázku běžným jazykem. Přečíst ho umí libovolný model ve vašem plánu a mezi modely můžete přepínat nad stejným souborem, aniž byste ho nahrávali znovu.

Než se na odpověď spolehnete, udělejte jednu věc: požádejte model, aby ocitoval pasáž, ze které vycházel. Nástroje, které soubor prohledávají místo toho, aby ho četly celý, hledají pasáže podle významu, a co jsou embeddingy v AI vysvětluje, jak to funguje. Sebejistá odpověď čerpaná z trénovacích dat místo z vašeho souboru je chyba, která lidi stojí peníze, a naváděcí otázka ji odhalí za zhruba deset sekund. Zbytek této stránky ukazuje, jak to dělat dobře.

Nejdřív potvrďte, že čte váš dokument

Nejnebezpečnější chyba v chatování s dokumenty není špatná odpověď, je to sebejistá odpověď čerpaná z trénovacích dat místo z vašeho souboru. Nejčastěji se to stává u dokumentů, které připomínají něco běžného: standardní komerční nájemní smlouvu, dobře známý předpis, široce probíranou studii. Model daný žánr zná dost dobře na to, aby vytvořil věrohodnou odpověď, aniž by nahlédl do vašeho konkrétního textu, a nic ve výstupu na to neupozorní.

Jeden zvyk to řeší. Než se zeptáte na svou skutečnou otázku, položte naváděcí otázku.

Ocituj pasáž z přiloženého dokumentu, která se týká [tématu], a uveď stránku nebo oddíl, kde se nachází. Pokud v dokumentu není, řekni to.

Pokud vrátí skutečný citát, čte váš soubor. Pokud vytvoří obecnou parafrázi nebo nenajde něco, o čem víte, že tam je, extrakce se nezdařila a každá další odpověď je podezřelá. Zabere to deset sekund a je to rozdíl mezi nástrojem a rizikem.

Tento zvyk přeneste i do skutečných otázek: Ocituj přesný text, který podporuje tvou odpověď by se mělo objevit v každém promptu, na jehož odpověď se budete spoléhat.

Výběr modelu pro daný dokument

DokumentModelProč
Zprávy nad 100 stran, podání, celé sady smluvGeminiKontextové okno 1 000 000 tokenů, takže je dokument skutečně celý přítomný, ne rozdělený na části
Smlouvy, směrnice, cokoli, kde záleží na formulaciClaudeNejlepší v nuancích a v tom, aby vám řekl, co dokument neříká
Faktury, formuláře, krátké strukturované souboryGPTRychlý a nejspolehlivější při přesné extrakci do tabulek nebo JSON
Studie s obrázky, skenované stránky, diagramyJakýkoli multimodální modelČte stránku jako obrázek tam, kde extrakce textu nestačí

Bod o kontextovém okně stojí za vysvětlení. Když dokument překročí to, co model pojme, musí se zpracovat po částech, a otázky, které vyžadují celý dokument najednou (odporuje si tu něco s článkem 14, je tento pojem někde definován, který ze tří oddílů je nekonzistentní) se stávají nespolehlivými. To je konkrétní důvod, proč u dlouhých souborů sáhnout po modelu s velkým kontextem, ne obecná preference.

Mezi modely můžete přepínat bez opětovného nahrávání, takže čtěte s jedním a extrahujte s druhým nad stejným souborem. Viz přepínání modelů uprostřed konverzace.

Prompty podle typu dokumentu

Smlouvy a dohody

Z přiložené smlouvy extrahuj do tabulky: dobu trvání a obnovení, výpovědní lhůtu, platební podmínky, limit odpovědnosti, náhrady škod, rozhodné právo, postoupení a jakoukoli klauzuli, která přežije ukončení smlouvy. U každé uveď číslo klauzule a ocituj operativní větu. Poté samostatně vypiš povinnosti, které dopadají na nás, ne na druhou stranu.

Navažte otázkou, na které skutečně záleží: Co je v této smlouvě nezvyklé v porovnání se standardními podmínkami pro tento typ smlouvy a co v ní naopak nápadně chybí? Riziko obvykle sídlí v tom, co chybí, a to je věc, kterou vyhledávání klíčových slov nikdy neodhalí.

Výzkumné studie

Z přiložené studie vrať: výzkumnou otázku, design studie, vzorek a populaci, primární výsledek, hlavní výsledek s velikostí efektu, uvedená omezení a zdroj financování. Poté mi řekni tři tvrzení v této studii, která by před citací potřebovala nezávislé ověření.

Dlouhé zprávy a podání

Shrň přiloženou zprávu do 10 odrážek seřazených podle důležitosti, ne podle pořadí v dokumentu. Poté vypiš: tři čísla, na kterých by rozhodovateli záleželo, s odkazy na stránku, cokoli, co zpráva prezentuje jako fakt bez zdroje, a jakékoli místo, kde se shrnutí nebo výkonná část neshoduje s detailem dále v dokumentu.

Tato poslední kontrola překvapivě často odhalí skutečné problémy. Výkonná shrnutí se píšou brzy a upravují se méně než oddíly, které shrnují.

Porovnání dvou dokumentů

Porovnej smlouva-a.pdf a smlouva-b.pdf klauzuli po klauzuli. Vrať tabulku všech podstatných rozdílů: téma, co říká A, co říká B, a čemu to prospívá. Ignoruj rozdíly ve formátování a číslování. Samostatně vypiš vše, co je v jednom a v druhém chybí.

Přeměna na něco použitelného

Přepiš zjištění pro vedení ve 150 slovech. Začni požadovaným rozhodnutím. Žádný nedefinovaný žargon. Označ vše, co bych měl před rozesláním ověřit.

Řešení problémů

„Nevidím dokument." Potvrďte, že se soubor dokončil nahrát, a v zprávě na něj výslovně odkažte jménem. U velmi dlouhých vláken je rychlejší znovu soubor připojit nebo začít nový chat jen s ním, než se o to hádat.

Skenované PDF, zkomolený nebo chybějící text. Dokument je obrázek, takže běžná extrakce textu nemá z čeho číst. Whizi rozpozná PDF s velkým podílem obrázků podle toho, jak málo textu jeho stránky vydají, a jednou ho projde serverovým vizuálním zpracováním, které vrátí přepis po stránkách. Přesnost klesá u nízkého rozlišení, nezvyklých fontů, ručního písma a hustých tabulek. Protože chybně přečtená číslice je v plynulé odpovědi nepostřehnutelná, ověřte každé číslo ze skenovaného dokumentu proti originální stránce.

Tabulky vycházejí špatně. Tabulky v PDF jsou pod povrchem notoricky špatně strukturované. Nejprve požádejte o přesnou reprodukci tabulky, zkontrolujte ji proti stránce a až poté žádejte o analýzu. Pro náročnou práci s tabulkami je multimodální model, který čte stránku jako obrázek, často spolehlivější než extrakce textu.

Něco přehlédl, o čem víte, že tam je. Položte naváděcí otázku. Pokud model nedokáže ocitovat pasáž, kterou vidíte, problém je v extrakci, ne v uvažování. Zkuste jiný model nebo nahrajte jen relevantní stránky.

Soubor je příliš velký. Použijte model s velkým kontextem, nebo rozdělte podle účelu, ne podle počtu stránek. Nahrát tři oddíly, které skutečně potřebujete, je lepší než nahrát 400 stran a doufat.

Odpovědi jsou s postupem konverzace vágnější. Dlouhá vlákna nahromadí kontext, který konkuruje dokumentu. Začněte nový chat se souborem a stručným popisem toho, co potřebujete.

Ověřte, než se spolehnete

Tři kontroly v pořadí podle důležitosti.

Požadujte citace u všeho podstatného. Ocitovanou pasáž lze ověřit za pár sekund, parafrázi ne. Tento jediný zvyk odstraní většinu rizika v práci s dokumenty.

Zkřížená kontrola druhým modelem. Zeptejte se na stejnou otázku jiného modelu nad stejným souborem. Shoda je smysluplný důkaz, neshoda vám přesně ukáže, kam se dívat. Whizi porovnání modelů vedle sebe je přesně k tomu.

Zeptejte se, čím si model není jistý. U které ze svých výše uvedených odpovědí jsi si nejméně jistý a co je v dokumentu nejednoznačné? Modely jsou v sebehodnocení nedokonalé, ale nejednoznačnosti, které odhalí, jsou obvykle skutečné nejasnosti ve zdroji, což je užitečná informace o samotném dokumentu.

A trvalé pravidlo pro vše, co s sebou nese důsledky, tedy právní, finanční, zdravotní nebo compliance materiály: model najde pasáž, rozhodnutí děláte vy. Je to pomocník ke čtení, ne poradce, a odpovědnost za rozhodnutí učiněné na základě jeho výstupu je zcela na vás.

Kontrolní seznam
  • Nejprve položte naváděcí otázku, abyste potvrdili, že model čte váš soubor
  • U každé podstatné odpovědi požadujte přesnou citaci
  • U dlouhých dokumentů použijte model s velkým kontextem, aby se nic neztratilo rozdělením
  • Ptejte se, co v dokumentu nápadně chybí, ne jen co v něm je
  • Ověřte čísla ze skenovaných dokumentů proti originální stránce
  • Tabulky nejprve reprodukujte přesně a zkontrolujte je, než je začnete analyzovat
  • Zkříženě ověřte cokoli důležitého druhým modelem

Časté dotazy

Jaká je maximální velikost PDF?

Na webu může být každý nahraný soubor až 100 MB a jedna zpráva může nést až 6 souborů; aplikace pro iOS omezuje soubor na 10 MB. V rámci toho je skutečným omezením kontextové okno modelu, ne limit souboru. Gemini ve Whizi má kontextové okno 1 000 000 tokenů, a proto je doporučením pro dlouhé zprávy, podání a sady více smluv. Nad tento rozsah nahrajte jen oddíly, které skutečně potřebujete, ne celý dokument, protože cílený kontext obvykle vede i k přesnější odpovědi.

Ukládá Whizi moje PDF soubory?

Nahrané soubory jsou uloženy pod vaším účtem, jsou nastaveny na vypršení po nejvýše 30 dnech a lze je kdykoli smazat dříve. Whizi nepoužívá vaše prompty, soubory, konverzace, hlasové přepisy ani vygenerovaný obsah k trénování AI modelů ve vlastnictví Whizi a tento obsah neprodává jako trénovací data. Smazání souboru neodstraní to, co o něm bylo v konverzaci již probráno, takže pokud je dokument citlivý natolik, že si zaslouží smazání, smažte i chat.

Můžu chatovat s více PDF najednou?

Ano, a porovnávání mezi dokumenty je právě zde nejcennější. Nahrajte více souborů do stejného vlákna a v promptech na ně odkazujte jménem, jinak si model sám vybere, ze kterého odpovídá, aniž by vám to řekl. Porovnání smluv klauzuli po klauzuli, slučování zjištění z více zpráv a hledání rozporů mezi dokumenty vše vyžaduje, aby bylo vše přítomné najednou, což je další důvod pro model s velkým kontextem.

Funguje to i se skenovanými PDF?

Ano. Whizi rozpozná skenované nebo obrázky bohaté PDF podle toho, jak málo textu jeho stránky vydají, a přepíše ho stránku po stránce serverovým vizuálním zpracováním. Přesnost je dobrá u čistých skenů a klesá u nízkého rozlišení, nezvyklých fontů, ručního písma a hustých tabulek. Protože chybně přečtený znak vytvoří chybné číslo uvnitř jinak plynulé odpovědi, kontrolujte jakékoli číslo ze skenovaného dokumentu proti originální stránce.

Jak zjistím, že odpověď skutečně pochází z mého dokumentu?

Požadujte citaci. Požádejte model, aby ocitoval přesnou pasáž podporující jeho odpověď, včetně stránky nebo oddílu, a aby jasně řekl, pokud daná informace v dokumentu není. Odpovědi čerpané z trénovacích dat místo z vašeho souboru jsou nejnebezpečnější chybou v chatování s dokumenty, právě proto, že jsou u běžných typů dokumentů věrohodné, a vyžadování ověřitelné citace je jediný spolehlivý způsob, jak rozdíl poznat.