Jak nahrát soubor do ChatGPT a dalších AI ve Whizi

Krátká odpověď

Soubor přiložte v okně pro psaní zprávy, buď přetažením, nebo kliknutím na ikonu sponky, a poté napište svůj dotaz. Whizi přijímá PDF, dokumenty Word, tabulky, obrázky a soubory s kódem nebo čistým textem. To, co model skutečně dostane, se liší podle typu souboru: u dokumentů je to extrahovaný text, u tabulek hodnoty buněk a u obrázků samotný obrázek.

Podporované typy souborů a co se s každým z nich skutečně stane

Soubor přiložte přetažením do okna pro psaní zprávy nebo kliknutím na ikonu sponky, a poté napište svůj dotaz. To, co model dostane, se liší podle typu souboru, a znalost tohoto rozdílu vysvětluje většinu překvapivých výsledků.

TypPříponyS čím model pracuje
Textová PDF.pdfExtrahovaný text v pořadí čtení, včetně tabulek jako textu
Naskenovaná PDF.pdfPřepis po stránkách ze serverového vizuálního rozpoznávání
Dokumenty Word.docxText dokumentu extrahovaný ve vašem prohlížeči
Tabulky.xlsx, .csvHodnoty buněk jako text, nikoli živé vzorce
Obrázky.png, .jpg, .jpegSamotný obrázek, čtený multimodálním modelem
Kód a čistý text.py, .js, .ts, .go, .md, .txt a podobnéObsah souboru bez úprav

Dva důsledky, které se vyplatí pochopit. Za prvé, tabulka dorazí jako hodnoty, ne jako funkční sešit, takže model umí přečíst, co váš vzorec vypočítal, ale nedokáže vzorec znovu spustit. Za druhé, naskenované PDF prošlo vizuálním přepisem, ne prostou extrakcí textu, a nezvyklé písmo, ručně psaná poznámka nebo nízké rozlišení skenu mohou stále způsobit chybné přečtení znaku v čísle. Čísla z naskenovaných dokumentů si vždy ověřte proti originálu. Poznámka k obrázkům: okno pro psaní zprávy soubory GIF odmítá a vyžádá si místo nich PNG nebo JPEG.

Připravte soubor, než se na cokoli zeptáte

Pět minut práce navíc tady vám ušetří zmatenou konverzaci později.

  • Pojmenujte soubor podle toho, co skutečně je. Model vidí název souboru, a 2025-q3-smlouva-dodavatel-acme.pdf mu dá užitečný kontext, který dokument(3).pdf neposkytne. Jakmile je v konverzaci více souborů, hraje to obrovskou roli.
  • Odešlete zdrojovou verzi, ne verzi pro prezentaci. Zvlášť u tabulek platí, že verze se sloučenými buňkami, mezisoučty uvnitř dat a poznámkami na okraji způsobuje mnohem víc chyb než velký, ale prostý soubor.
  • Rozsáhlé dokumenty dělte podle účelu, ne podle velikosti. Pokud potřebujete jen část o metodologii a výsledcích, je lepší nahrát právě tu, než nahrávat 400 stran a doufat, že si model vybere správné místo.
  • Odstraňte osobní údaje, které nepotřebujete. Jména, e-maily a identifikátory jsou pro analýzu jen zřídka nutné, a jejich odstranění je rychlejší než řešit, zda jste je vůbec měli oprávnění nahrát.
  • Ověřte, že PDF je skutečně textové. Zkuste ve svém PDF prohlížeči vybrat text. Pokud to nejde, jde o skenovaný dokument, Whizi ho přepíše pomocí vizuálního rozpoznávání a čísla stojí za kontrolu proti originálu.

Výběr modelu podle souboru

Tato volba je u práce s dokumenty důležitější než samotný prompt.

  • Gemini na cokoli dlouhého. Modely Gemini ve Whizi mají kontextové okno 1 000 000 tokenů, takže 200stránková zpráva, celá sada smluv nebo desítka článků může být přítomna najednou místo zpracování po částech. Otázky napříč dokumenty fungují správně jen tehdy, když je vše skutečně v kontextu.
  • Claude na nuance. Právní jazyk, dokumenty o zásadách, cokoli, kde smysl závisí na podmínkách a zmírňujících formulacích. Je také nejlepší v tom, když má říct, co dokument neříká, což je často ta skutečná otázka.
  • GPT na extrakci. Faktury, formuláře, strukturovaná data, cokoli, kde chcete zpět přesnou tabulku nebo JSON a konzistentní názvy polí ve stovkách řádků.
  • Jakýkoli multimodální model na obrázky, grafy, snímky obrazovky a diagramy. Nejprve ho požádejte, aby popsal, co vidí, a až pak o interpretaci, což odhalí chybné přečtení hned na začátku.

Model můžete uprostřed konverzace přepnout bez opětovného nahrávání souboru, a to je smysl práce v jednom pracovním prostoru. Čtěte s Gemini, extrahujte s GPT a shrnutí napište s Claude, vše nad stejným přiloženým souborem. Viz přepínání modelů uprostřed konverzace.

Práce s několika dokumenty najednou

Otázky k jednomu dokumentu jsou užitečné. Otázky k více dokumentům jsou místo, kde už to není jen pohodlí, ale schopnost, kterou jste dřív neměli.

Prompt: porovnat

Porovnej smlouva-a.pdf a smlouva-b.pdf. Vrať tabulku všech klauzulí, které se liší: klauzule, co říká A, co říká B, a která je pro nás výhodnější a proč. Ignoruj rozdíly ve formátování a číslování. Klauzule přítomné jen v jednom dokumentu vypiš samostatně.

Prompt: konsolidovat

Ve všech přiložených souborech postav jednu tabulku odpovídající na [otázka]. Jeden řádek na dokument, s názvem dokumentu v prvním sloupci. Kde se dokument k tomu nevyjadřuje, napiš NEŘEŠENO. Nespojuj dokumenty, které používají různé definice, aniž bys to upozornil.

Prompt: najít rozpor

Kde se tyto dokumenty vzájemně vyvracejí? Citujte obě pasáže vedle sebe a uveďte, ze kterého souboru každá pochází. Odliš skutečné rozpory od rozdílů v rozsahu nebo datu.

Jakmile je v konverzaci víc než jeden soubor, vždy v promptu odkazujte na soubory jménem. "V dodavatelské smlouvě, jaká je výpovědní lhůta?" je jednoznačné; "jaká je výpovědní lhůta?" nutí model, aby si vybral, a neřekne vám, který soubor zvolil.

Když odpověď vypadá špatně

Krátký diagnostický postup, který vyřeší většinu problémů.

Model tvrdí, že soubor nevidí. Ověřte, že se příloha skutečně nahrála, a pak na ni v dotazu explicitně odkažte: "V příloze zpráva.pdf". Zvlášť u obrázků platí, že fráze "podívej se na přiložený obrázek" zajistí použití multimodální cesty, místo aby model odpovídal jen z textu vaší otázky.

Odpověď se vztahuje ke špatnému dokumentu. Jakmile má konverzace více souborů, jmenujte soubor v každé otázce.

Čísla jsou u naskenovaného dokumentu jemně špatně. Jde o přepis skenu, ne o uvažování. Požádejte model, aby přesně ocitoval okolní řádek, abyste viděli, co přečetl, a pak to ověřte proti originálu.

Model přehlédl něco, co víte, že tam je. Nejprve položte lokalizační otázku: Ocituj pasáž, která pojednává o [téma], a uveď její stránku nebo kapitolu. Pokud ji nenajde, problém je v extrakci, ne v uvažování. Zkuste jiný model nebo nahrajte relevantní stránky samostatně.

Model místo odpovědi shrnuje. Požádejte o důkaz, ne o závěr: Ocituj přesný text, který podporuje tvou odpověď. Tím se zachytí i případ, kdy byla odpověď odvozena z obecných znalostí, ne z vašeho dokumentu, což je nejdůležitější chyba, kterou je třeba odhalit.

Poslední kontrola si zaslouží zdůraznění. Model dotázaný na známý typ smlouvy, běžnou regulaci nebo slavnou publikaci může odpovědět věrohodně z trénovacích dat, aniž by váš soubor vůbec otevřel. Požadavek na citaci vynutí, aby odpověď byla zakotvená v dokumentu, který má skutečně před sebou.

Ochrana soukromí, co zvážit před nahráním

Nahrané přílohy jsou nastaveny tak, aby vypršely nejpozději po 30 dnech, a soubor nebo celou konverzaci si sami můžete smazat i dřív. Whizi nepoužívá vaše prompty, soubory, konverzace, hlasové přepisy ani vygenerovaný obsah k trénování AI modelů ve vlastnictví Whizi a tento obsah neprodává jako trénovací data. Poskytovatel provozující vybraný model dostane to, co potřebuje k odpovědi, a může dočasně ukládat data do mezipaměti podle svých vlastních zásad.

Rozhodnutí, které zůstává na vás, je, zda je dokument vůbec takový, který máte oprávnění zpracovat prostřednictvím služby třetí strany. Kategorie, u kterých se vyplatí zastavit: osobní údaje jiných lidí, cokoli podléhající konkrétní klauzuli o mlčenlivosti, neveřejné materiální informace a regulovaná data, jako jsou zdravotní nebo finanční záznamy podléhající zvláštním pravidlům pro nakládání.

Praktickou střední cestou pro většinu lidí je redigovat, ne se zdržet nahrání úplně. Jména nahrazená rolemi, hodnoty indexované místo absolutních a odstraněné identifikátory zachovají vše potřebné pro analýzu, a přitom odstraní většinu toho, co dělá dokument citlivým.

Kontrolní seznam
  • Pojmenovávejte soubory popisně, protože model vidí název souboru
  • Před důvěrou v extrahovaná čísla zkontrolujte, zda je PDF text, nebo skenovaný obraz
  • Nahrávejte zdrojovou tabulku, ne naformátovanou verzi pro prezentaci
  • Na dlouhé soubory zvolte Gemini, na nuance Claude, na extrakci GPT
  • Jakmile je přiložen víc než jeden soubor, odkazujte na soubory jménem
  • Vyžádejte si podpůrnou citaci, aby odpovědi zůstaly zakotvené v dokumentu
  • Odstraňte osobní údaje, které pro analýzu nepotřebujete

Časté dotazy

Jsou moje nahrané soubory soukromé?

Nahrané soubory se ukládají pod vaším účtem, jsou nastaveny tak, aby vypršely nejpozději po 30 dnech, a kdykoli je můžete smazat dřív. Whizi nepoužívá vaše prompty, soubory, konverzace, hlasové přepisy ani vygenerovaný obsah k trénování AI modelů ve vlastnictví Whizi a tento obsah neprodává jako trénovací data. Na vás zůstává rozhodnutí, zda je daný dokument takový, který máte oprávnění poslat službě třetí strany, což se obvykle řídí vašimi vlastními smlouvami nebo interními zásadami, ne našimi.

Jaká je maximální velikost souboru?

Na webu může mít každý soubor až 100 MB a jedna zpráva může nést až 6 souborů; aplikace pro iOS omezuje soubor na 10 MB. V rámci těchto limitů je závazným omezením kontextové okno modelu: u dlouhých smluv, zpráv a sad více dokumentů zvolte model s velkým kontextem, jako je Gemini, nebo nahrajte jen relevantní části, ne celý soubor, protože cílený kontext obvykle vede k lepší odpovědi tak jako tak.

Můžu soubor po konverzaci smazat?

Ano, soubory lze odstranit kdykoli, a nahrané soubory, které nechte být, jsou nastaveny tak, aby samy vypršely nejpozději po 30 dnech. Odstranění souboru zpětně nesmaže, co už bylo v konverzaci probráno, takže pokud je obsah citlivý natolik, že si zaslouží smazat soubor, smažte i celou konverzaci.

Funguje to i s naskenovanými PDF?

Ano. Whizi detekuje obrazově náročné nebo skenované PDF podle toho, jak málo textu jeho stránky vydají, a jednou ho odešle přes serverové vizuální rozpoznávání, které vrátí přepis po stránkách. Přesnost je u čistých skenů vysoká a klesá u nízkého rozlišení, nezvyklých písem, rukopisu a složitých rozvržení tabulek. Protože chybně přečtený znak v čísle je v plynulé odpovědi nerozeznatelný, každé číslo z naskenovaného dokumentu ověřte proti originálu.

Můžu do jedné konverzace nahrát více dokumentů?

Ano, a je to místo, kde je většina skutečné hodnoty. Porovnávání dvou smluv klauzuli po klauzuli, konsolidace zjištění napříč sadou zpráv nebo hledání rozporů mezi dokumenty jsou všechno věci, které vyžadují, aby bylo vše najednou v kontextu. Jakmile je souborů víc než jeden, odkazujte na ně v promptech jménem, jinak si model vybere sám a neřekne vám, který zvolil.