Sådan uploader du PDF til AI i Whizi

Kort svar

Vedhæft filen i chatvinduet ved at trække den ind eller klikke på papirclipsikonet, og stil derefter dit spørgsmål. Whizi accepterer PDF'er, Word-dokumenter, regneark, billeder og kode- eller ren tekstfiler. Hvad modellen får at se, afhænger af filtypen: udtrukket tekst for dokumenter, celleværdier for regneark og selve billedet for billedfiler.

Understøttede filtyper, og hvad der egentlig sker med hver af dem

Vedhæft filen ved at trække den ind i chatvinduet eller klikke på papirclipsikonet, og stil derefter dit spørgsmål. Hvad modellen får at se, afhænger af filtypen, og det forklarer det meste af de overraskende resultater.

TypeFiltyperHvad modellen arbejder med
Tekst-PDF'er.pdfDen udtrukne tekst, i læserækkefølge, inklusive tabeller som tekst
Scannede PDF'er.pdfEt transskript pr. side fra en server-baseret billedanalyse
Word-dokumenter.docxDokumentteksten, udtrukket i din browser
Regneark.xlsx, .csvCelleværdier som tekst, ikke levende formler
Billeder.png, .jpg, .jpegSelve billedet, læst af en multimodal model
Kode og ren tekst.py, .js, .ts, .go, .md, .txt og lignendeFilens indhold ordret

To ting er værd at huske. For det første kommer et regneark ind som værdier og ikke som en fungerende arbejdsbog, så modellen kan læse, hvad din formel har givet som resultat, men kan ikke selv genkøre formlen. For det andet er en scannet PDF gået igennem en billedbaseret transskription i stedet for almindelig tekstudtræk, og en usædvanlig skrifttype, en håndskrevet note eller en scanning i lav opløsning kan stadig give et fejllæst tegn i et tal. Kontroller altid tal fra scannede dokumenter mod originalen. En sidebemærkning om billeder: chatvinduet afviser GIF-filer og beder om en PNG eller JPEG i stedet.

Forbered filen, før du spørger om noget

Fem minutter her sparer dig for en forvirrende samtale senere.

  • Navngiv filen efter, hvad den er. Modellen ser filnavnet, og 2025-q3-leverandoerkontrakt-acme.pdf giver den nyttig kontekst, som dokument(3).pdf ikke gør. Det betyder også utroligt meget, når først flere filer er i samme samtale.
  • Send kildefilen, ikke præsentationsversionen. Især for regneark giver versionen med sammenlagte celler, subtotaler inde i dataene og noter i margenen langt flere fejl end en stor almindelig fil gør.
  • Del enorme dokumenter op efter formål, ikke efter størrelse. Hvis du kun har brug for metode- og resultatafsnittene, er det bedre at uploade dem end at uploade 400 sider og håbe, at opmærksomheden lander det rigtige sted.
  • Fjern personlige oplysninger, du ikke har brug for. Navne, e-mails og identifikatorer er sjældent nødvendige for analysen, og at fjerne dem er hurtigere end at skulle vurdere, om du havde ret til at uploade dem.
  • Kontroller, at en PDF faktisk er tekst. Prøv at markere tekst i din PDF-læser. Kan du ikke det, er det en scanning, Whizi vil transskribere den med en billedanalyse, og tal bør kontrolleres mod originalen.

Vælg den rigtige model til filen

Dette valg betyder mere end selve prompten, når det gælder dokumentarbejde.

  • Gemini til alt langt. Gemini-modellerne i Whizi har et kontekstvindue på 1.000.000 tokens, hvilket betyder, at en rapport på 200 sider, et helt sæt kontrakter eller et dusin artikler kan være til stede på samme tid i stedet for at blive behandlet i bidder. Spørgsmål på tværs af dokumenter fungerer kun ordentligt, når alt reelt er i konteksten.
  • Claude til nuancer. Juridisk sprog, politikdokumenter, alt hvor betydningen afhænger af forbehold og forsigtige formuleringer. Den er også bedst til at fortælle dig, hvad et dokument ikke siger, hvilket ofte er det egentlige spørgsmål.
  • GPT til udtræk. Fakturaer, formularer, strukturerede data, alt hvor du vil have en stram tabel eller JSON tilbage og ensartede feltnavne over hundrede rækker.
  • Enhver multimodal model til billeder, diagrammer, skærmbilleder og illustrationer. Bed den om at beskrive, hvad den ser, før du beder den om at tolke det, hvilket fanger fejllæsninger tidligt.

Du kan skifte model midt i en samtale uden at uploade filen igen, hvilket er hele pointen med at gøre det i ét arbejdsområde. Læs med Gemini, uddrag med GPT, og lad Claude skrive opsummeringen, alt sammen med samme vedhæftede fil. Se skift af model midt i en samtale.

Arbejd med flere dokumenter samtidig

Spørgsmål til et enkelt dokument er nyttige. Spørgsmål til flere dokumenter er der, hvor dette stopper med at være en bekvemmelighed og bliver en mulighed, du ikke havde før.

Prompt: sammenlign

Sammenlign kontrakt-a.pdf og kontrakt-b.pdf. Returner en tabel over hver klausul, der er forskellig: klausul, hvad A siger, hvad B siger, og hvad der er mest fordelagtigt for os og hvorfor. Ignorer forskelle i formatering og nummerering. List klausuler, der findes i den ene og ikke i den anden, hver for sig.

Prompt: samlet oversigt

Byg en tabel ud fra alle vedhæftede filer, der besvarer [spørgsmål]. En række pr. dokument, med dokumentnavnet i den første kolonne. Hvor et dokument ikke behandler det, skriv IKKE BEHANDLET. Sammenlæg ikke dokumenter, der bruger forskellige definitioner, uden at markere det.

Prompt: find modsætningen

Hvor modsiger disse dokumenter hinanden? Citer begge passager side om side, og angiv, hvilken fil hver kommer fra. Skeln mellem reelle modsætninger og forskelle i omfang eller dato.

Henvis altid til filer ved navn i din prompt, når der er mere end en. "I leverandøraftalen, hvad er opsigelsesfristen?" er entydigt; "hvad er opsigelsesfristen?" tvinger modellen til at vælge, og den fortæller ikke, hvilken den valgte.

Når svaret ser forkert ud

En kort fejlfindingsrækkefølge, der løser de fleste problemer.

Modellen siger, den ikke kan se filen. Bekræft, at filen faktisk blev uploadet, og henvis derefter direkte til den: "I den vedhæftede rapport.pdf". Særligt for billeder sikrer det at sige "kig på det vedhæftede billede", at den multimodale vej bliver brugt, i stedet for at modellen svarer alene ud fra teksten i dit spørgsmål.

Svaret handler om det forkerte dokument. Navngiv filen i hvert spørgsmål, når samtalen har flere.

Tallene er lidt forkerte på et scannet dokument. Det er transskriptionen af scanningen, ikke ræsonnementet. Bed modellen om at citere den omgivende linje ordret, så du kan se, hvad den læste, og kontroller derefter originalen.

Den overså noget, du ved er i dokumentet. Stil først et lokaliserende spørgsmål: Citer passagen, der omtaler [emne], og angiv dens side eller afsnit. Hvis den ikke kan finde det, er udtrækket problemet, ikke ræsonnementet. Prøv en anden model, eller upload de relevante sider separat.

Den opsummerer i stedet for at svare. Bed om beviset i stedet for konklusionen: Citer den nøjagtige tekst, der understøtter dit svar. Det fanger også de tilfælde, hvor svaret er gættet fra generel viden i stedet for fra dit dokument, hvilket er den vigtigste fejl at fange.

Det sidste punkt er værd at understrege. En model, der bliver spurgt om en velkendt kontrakttype, en almindelig regel eller en berømt artikel, kan svare plausibelt ud fra træningsdata uden overhovedet at have kigget i din fil. Krav om et citat tvinger svaret til at være forankret i det dokument, der reelt ligger foran den.

Privatliv, og hvad du bør overveje før upload

Uploadede filer er sat til at udløbe efter op til 30 dage, og du kan selv slette en fil eller en hel samtale tidligere. Whizi bruger ikke dine prompter, filer, samtaler, taletransskriptioner eller genereret indhold til at træne Whizi-ejede AI-modeller og sælger ikke det indhold som træningsdata. Den udbyder, der driver den model, du har valgt, får det, den skal bruge for at svare, og kan gemme midlertidige caches efter sin egen politik.

Den vurdering, der stadig er din, er, om dokumentet overhovedet er noget, du har ret til at behandle med en tredjepartstjeneste. De kategorier, det er værd at stoppe op ved: personoplysninger om andre mennesker, alt der er omfattet af en specifik fortrolighedsklausul, væsentlige ikke-offentlige oplysninger og reguleret data som sundheds- eller finansielle oplysninger, der er underlagt særlige håndteringsregler.

Den praktiske mellemvej for de fleste er at anonymisere frem for at afholde sig fra det. Navne udskiftet med roller, tal angivet som indeks i stedet for absolutte værdier, og identifikatorer fjernet vil bevare alt, hvad analysen har brug for, mens det meste af det, der gør et dokument følsomt, forsvinder.

Tjekliste
  • Navngiv filer beskrivende, fordi modellen ser filnavnet
  • Kontroller, om en PDF er tekst eller en scanning, før du stoler på udtrukne tal
  • Upload kilderegnearket, ikke den formaterede præsentationsversion
  • Vælg Gemini til lange filer, Claude til nuancer, GPT til udtræk
  • Henvis til filer ved navn, når mere end en er vedhæftet
  • Bed om et understøttende citat, så svar forbliver forankret i dokumentet
  • Fjern personlige oplysninger, du ikke har brug for til analysen

Ofte stillede spørgsmål

Er mine uploads private?

Uploads gemmes under din konto, er sat til at udløbe efter op til 30 dage og kan slettes tidligere, når du vil. Whizi bruger ikke dine prompter, filer, samtaler, taletransskriptioner eller genereret indhold til at træne Whizi-ejede AI-modeller og sælger ikke det indhold som træningsdata. Det, der stadig er dit ansvar, er, om et givent dokument er noget, du har ret til at sende til en tredjepartstjeneste, hvilket normalt afgøres af dine egne kontrakter eller interne politikker snarere end vores.

Hvad er den maksimale filstørrelse?

På hjemmesiden kan hver fil være op til 100 MB, og en besked kan indeholde op til 6 filer; iOS-appen sætter grænsen for en fil ved 10 MB. Inden for de grænser er det bindende krav modellens kontekstvindue: til lange kontrakter, rapporter og sæt med flere dokumenter, vælg en model med stort kontekstvindue som Gemini, eller upload de relevante afsnit i stedet for hele filen, da målrettet kontekst normalt giver et bedre svar alligevel.

Kan jeg slette en fil efter at have chattet?

Ja, filer kan fjernes når som helst, og uploads du lader ligge, er sat til at udløbe af sig selv efter op til 30 dage. Bemærk, at fjernelse af en fil ikke bagudrettet fjerner det, der allerede er blevet diskuteret i samtalen, så hvis indholdet er følsomt nok til at berettige, at filen slettes, bør samtalen slettes med.

Fungerer det med scannede PDF'er?

Ja. Whizi opdager en billedtung eller scannet PDF på, hvor lidt tekst dens sider giver, og sender den én gang igennem en server-baseret billedanalyse, der returnerer et transskript pr. side. Nøjagtigheden er høj på rene scanninger og falder ved lav opløsning, usædvanlige skrifttyper, håndskrift og komplekse tabellayout. Fordi et fejllæst tegn i et tal er usynligt i et flydende svar, bør ethvert tal fra et scannet dokument kontrolleres mod originalen.

Kan jeg uploade flere dokumenter til samme samtale?

Ja, og det er der, hvor det meste af værdien ligger. At sammenligne to kontrakter klausul for klausul, samle resultater fra en række rapporter, eller finde modsætninger mellem dokumenter, er alt sammen ting, der kræver, at alt er i konteksten på samme tid. Henvis til filer ved navn i dine prompter, når der er mere end en, ellers vælger modellen for dig uden at sige, hvilken den valgte.