Støttede filtyper, og hva som faktisk skjer med hver av dem
Legg til filen ved å dra den inn i meldingsfeltet eller klikke på binders-ikonet, og still deretter spørsmålet ditt. Hva modellen faktisk mottar, varierer fra filtype til filtype, og å vite hvilken som er hvilken forklarer det meste av de overraskende resultatene.
| Type | Filtyper | Hva modellen jobber med |
|---|---|---|
| Tekst-PDF-er | Den uttrukne teksten, i lesevennlig rekkefølge, inkludert tabeller som tekst | |
| Skannede PDF-er | En side-for-side-transkripsjon fra en serverside bildeanalyse | |
| Word-dokumenter | .docx | Dokumentteksten, hentet ut i nettleseren din |
| Regneark | .xlsx, .csv | Celleverdier som tekst, ikke levende formler |
| Bilder | .png, .jpg, .jpeg | Selve bildet, lest av en multimodal modell |
| Kode og ren tekst | .py, .js, .ts, .go, .md, .txt og lignende | Filinnholdet ordrett |
To konsekvenser er verdt å ta innover seg. Først kommer et regneark som verdier og ikke som en fungerende arbeidsbok, så modellen kan lese hva formelen din produserte, men kan ikke kjøre formelen på nytt. For det andre har en skannet PDF gått gjennom en bildetranskripsjon i stedet for vanlig tekstuthenting, og en uvanlig skrifttype, en håndskrevet kommentar eller en skanning med lav oppløsning kan fortsatt gi et feillest tegn i et tall. Kontroller tall fra skannede dokumenter mot originalen. En bildenote: meldingsfeltet avviser GIF-filer og ber om en PNG eller JPEG i stedet.
Forbered filen før du spør om noe
Fem minutter her sparer en forvirrende samtale senere.
- Gi filen et navn som beskriver hva den er. Modellen ser filnavnet, og
2025-q3-vendor-contract-acme.pdfgir den nyttig kontekst somdocument(3).pdfikke gjør. Det betyr også enormt mye når flere filer er med i tråden. - Send kildefilen, ikke presentasjonsversjonen. Særlig for regneark gir versjonen med sammenslåtte celler, subtotaler inni dataene og notater i margen langt flere feil enn en stor, enkel fil gjør.
- Del opp enorme dokumenter etter formål, ikke etter størrelse. Hvis du bare trenger metode- og resultatdelene, er det bedre å laste opp dem enn å laste opp 400 sider og håpe at oppmerksomheten lander på riktig sted.
- Fjern personopplysninger du ikke trenger. Navn, e-poster og identifikatorer er sjelden nødvendige for analysen, og å fjerne dem er raskere enn å vurdere om du hadde lov til å laste dem opp.
- Kontroller at en PDF faktisk er tekst. Prøv å markere tekst i PDF-leseren din. Hvis du ikke kan det, er det en skanning, Whizi vil transkribere den med en bildeanalyse, og tallene bør kontrolleres mot originalen.
Velge riktig modell for filen
Dette valget betyr mer enn selve promptet når du jobber med dokumenter.
- Gemini for alt som er langt. Gemini-modellene i Whizi har et kontekstvindu på 1 000 000 token, som betyr at en rapport på 200 sider, et helt kontraktsett eller et dusin artikler kan være til stede samtidig i stedet for å bli behandlet i deler. Spørsmål på tvers av dokumenter fungerer bare skikkelig når alt faktisk ligger i konteksten.
- Claude for nyanser. Juridisk språk, policydokumenter, alt der betydningen avhenger av forbehold og formuleringer. Den er også best på å si hva et dokument ikke sier, noe som ofte er selve spørsmålet.
- GPT for uttrekk. Fakturaer, formularer, strukturerte data, alt der du vil ha en fast tabell eller JSON tilbake med konsistente feltnavn over hundre rader.
- Enhver multimodal modell for bilder, diagrammer, skjermbilder og illustrasjoner. Be den beskrive hva den ser før du ber den tolke det, noe som fanger opp feillesninger tidlig.
Du kan bytte modell midt i en tråd uten å laste opp på nytt, og det er selve poenget med å gjøre dette i ett arbeidsområde. Les med Gemini, hent ut data med GPT, og la Claude skrive sammendraget, alt mot samme vedlagte fil. Se å bytte modell midt i en samtale.
Å jobbe med flere dokumenter samtidig
Spørsmål om ett enkelt dokument er nyttig. Spørsmål om flere dokumenter er der dette går fra å være en bekvemmelighet til å bli en mulighet du ikke hadde før.
Prompt: sammenligne
Sammenlign contract-a.pdf og contract-b.pdf. Gi en tabell over hver klausul som er forskjellig: klausul, hva A sier, hva B sier, og hvilken som er mest fordelaktig for oss og hvorfor. Ignorer forskjeller i formatering og nummerering. List opp klausuler som finnes i den ene og ikke i den andre, separat.
Prompt: konsolidere
Bygg én tabell basert på alle vedlagte filer som svarer på [spørsmål]. En rad per dokument, med dokumentnavnet i den første kolonnen. Der et dokument ikke tar opp dette, skriv IKKE OMTALT. Slå ikke sammen dokumenter som bruker forskjellige definisjoner uten å flagge det.
Prompt: finn motsigelsen
Hvor motsier disse dokumentene hverandre? Siter begge avsnittene side ved side og angi hvilken fil hver av dem kommer fra. Skill ekte motsigelser fra forskjeller i omfang eller dato.
Referer alltid til filer med navn i promptet ditt når det er mer enn én. «I leverandøravtalen, hva er oppsigelsestiden?» er uten tvil klart; «hva er oppsigelsestiden?» tvinger modellen til å velge, og den vil ikke fortelle deg hvilken den valgte.
Når svaret ser feil ut
En kort diagnostisk sekvens som løser de fleste problemer.
Modellen sier at den ikke kan se filen. Bekreft at vedlegget faktisk ble lastet opp, og referer deretter til det eksplisitt: «I den vedlagte report.pdf». Særlig for bilder sikrer det å si «se på det vedlagte bildet» at den multimodale veien brukes, i stedet for at modellen svarer utelukkende basert på teksten i spørsmålet ditt.
Svaret handler om feil dokument. Angi filnavnet i hvert spørsmål når tråden har flere.
Tallene er subtilt feil i et skannet dokument. Dette er transkripsjonen av skanningen, ikke resonneringen. Be modellen sitere den omkringliggende linjen ordrett, slik at du kan se hva den leste, og kontroller deretter originalen.
Den gikk glipp av noe du vet står der. Still et lokaliserende spørsmål først: Siter avsnittet som omhandler [tema] og angi side eller avsnitt. Hvis den ikke finner det, er det uttrekket som er problemet, ikke resonneringen. Prøv en annen modell eller last opp de relevante sidene separat.
Den oppsummerer i stedet for å svare. Be om bevisene i stedet for konklusjonen: Siter den eksakte teksten som støtter svaret ditt. Dette fanger også opp tilfellet der svaret ble utledet fra generell kunnskap i stedet for fra dokumentet ditt, som er den viktigste feilen å fange opp.
Den siste kontrollen fortjener å bli understreket. En modell som blir spurt om en velkjent kontrakttype, en vanlig regel eller en kjent artikkel, kan svare troverdig basert på treningsdata uten å konsultere filen din i det hele tatt. Å kreve et sitat tvinger svaret til å være forankret i dokumentet som faktisk ligger foran den.
Personvern, og hva du bør tenke på før du laster opp
Opplastede vedlegg er satt til å utløpe etter opptil 30 dager, og du kan selv slette en fil eller en hel samtale tidligere. Whizi bruker ikke promptene, filene, samtalene, taletranskripsjonene eller det genererte innholdet ditt til å trene Whizi-eide AI-modeller, og selger ikke dette innholdet som treningsdata. Leverandøren som kjører modellen du valgte, mottar det den trenger for å svare, og kan ha midlertidige mellomlagre under sin egen policy.
Vurderingen som fortsatt er din egen, er om dokumentet i det hele tatt er noe du har lov til å behandle med en tredjepartstjeneste. Kategoriene det er verdt å stoppe opp ved: personopplysninger som tilhører andre personer, alt som dekkes av en spesifikk konfidensialitetsklausul, vesentlig ikke-offentlig informasjon, og regulerte data som helse- eller finansopplysninger underlagt særskilte behandlingsregler.
Den praktiske mellomveien for de fleste er å sladde i stedet for å avstå helt. Navn erstattet med roller, tall indeksert i stedet for absolutte, og identifikatorer fjernet vil bevare alt analysen trenger, samtidig som det fjerner det meste av det som gjør et dokument sensitivt.
- Gi filer beskrivende navn, siden modellen ser filnavnet
- Kontroller om en PDF er tekst eller en skanning før du stoler på uttrukne tall
- Last opp kilderegnearket, ikke den formaterte presentasjonsversjonen
- Velg Gemini for lange filer, Claude for nyanser, GPT for uttrekk
- Referer til filer med navn når mer enn én er vedlagt
- Be om et støttende sitat, slik at svarene forblir forankret i dokumentet
- Fjern personopplysninger du ikke trenger for analysen
Vanlige spørsmål
Er filene mine private?
Opplastinger lagres under kontoen din, er satt til å utløpe etter opptil 30 dager, og kan slettes tidligere når du vil. Whizi bruker ikke promptene, filene, samtalene, taletranskripsjonene eller det genererte innholdet ditt til å trene Whizi-eide AI-modeller, og selger ikke dette innholdet som treningsdata. Det som fortsatt er din avgjørelse, er om et gitt dokument er noe du har lov til å sende til en tredjepartstjeneste, noe som vanligvis styres av dine egne kontrakter eller interne retningslinjer, ikke av våre.
Hva er maksimal filstørrelse?
På nettsiden kan hver fil være opptil 100 MB, og en melding kan inneholde opptil 6 filer; iOS-appen setter et tak på 10 MB per fil. Innenfor disse grensene er den bindende begrensningen modellens kontekstvindu: for lange kontrakter, rapporter og sett med flere dokumenter, velg en modell med stor kontekst som Gemini, eller last opp de relevante avsnittene i stedet for hele filen, siden målrettet kontekst vanligvis gir et bedre svar likevel.
Kan jeg slette en fil etter å ha chattet?
Ja, filer kan fjernes når som helst, og opplastinger du lar være i fred er satt til å utløpe automatisk etter opptil 30 dager. Merk at det å fjerne en fil ikke retroaktivt sletter det som allerede er diskutert i samtalen, så hvis innholdet er sensitivt nok til å rettferdiggjøre at du sletter filen, bør du også slette samtalen.
Fungerer det med skannede PDF-er?
Ja. Whizi oppdager en bildetung eller skannet PDF basert på hvor lite tekst sidene gir, og sender den én gang gjennom en serverside bildeanalyse som returnerer en side-for-side-transkripsjon. Nøyaktigheten er høy på rene skanninger og faller ved lav oppløsning, uvanlige skrifttyper, håndskrift og komplekse tabelloppsett. Fordi et feillest tegn i et tall er usynlig i et flytende svar, bør du kontrollere ethvert tall fra et skannet dokument mot originalen.
Kan jeg laste opp flere dokumenter til samme samtale?
Ja, og det er der det meste av verdien ligger. Å sammenligne to kontrakter klausul for klausul, konsolidere funn fra et sett med rapporter, eller finne motsigelser mellom dokumenter, krever alle at alt er i konteksten samtidig. Referer til filer med navn i promptene dine når det er mer enn én, ellers velger modellen for deg uten å si hvilken den valgte.