Cum să încarci documente în AI pe Whizi

Răspuns rapid

Atașează fișierul în caseta de conversație, fie trăgându-l acolo, fie apăsând pe iconița agrafă, apoi pune-ți întrebarea. Whizi acceptă PDF-uri, documente Word, foi de calcul, imagini și fișiere de cod sau text simplu. Ce primește modelul diferă în funcție de tip: text extras pentru documente, valorile celulelor pentru foile de calcul și imaginea propriu-zisă pentru poze.

Tipuri de fișiere acceptate, și ce se întâmplă de fapt cu fiecare

Atașează fișierul trăgându-l în caseta de conversație sau apăsând pe iconița agrafă, apoi pune-ți întrebarea. Ce primește modelul diferă în funcție de tipul fișierului, iar cunoașterea acestei diferențe explică majoritatea rezultatelor surprinzătoare.

TipExtensiiCu ce lucrează modelul
PDF-uri cu text.pdfTextul extras, în ordinea citirii, inclusiv tabelele ca text
PDF-uri scanate.pdfO transcriere pe pagină, obținută printr-o trecere de recunoaștere vizuală pe server
Documente Word.docxTextul documentului, extras în browser
Foi de calcul.xlsx, .csvValorile celulelor ca text, nu formule active
Imagini.png, .jpg, .jpegImaginea propriu-zisă, citită de un model multimodal
Cod și text simplu.py, .js, .ts, .go, .md, .txt și similareConținutul fișierului, cuvânt cu cuvânt

Două consecințe merită reținute. Întâi, o foaie de calcul ajunge sub formă de valori, nu ca un registru de calcul funcțional, deci modelul poate citi ce a produs formula ta, dar nu poate reexecuta formula. Apoi, un PDF scanat a trecut printr-o transcriere vizuală, nu printr-o extragere de text simplu, iar un font neobișnuit, o adnotare de mână sau o scanare cu rezoluție mică pot totuși produce un caracter citit greșit într-un număr. Verifică cifrele din documentele scanate comparativ cu originalul. O observație despre imagini: caseta de conversație refuză fișierele GIF și cere în schimb un PNG sau JPEG.

Pregătește fișierul înainte să pui vreo întrebare

Cinci minute investite aici îți scutesc o conversație confuză mai târziu.

  • Denumește fișierul după ce reprezintă. Modelul vede numele fișierului, iar 2025-q3-vendor-contract-acme.pdf îi oferă un context util pe care document(3).pdf nu îl oferă. Contează enorm mai ales odată ce sunt mai multe fișiere în conversație.
  • Trimite sursa, nu versiunea de prezentare. Mai ales pentru foile de calcul, versiunea cu celule îmbinate, subtotaluri în interiorul datelor și note pe margine provoacă mult mai multe erori decât un fișier simplu, dar mare.
  • Împarte documentele foarte mari după scop, nu după dimensiune. Dacă ai nevoie doar de secțiunile de metodologie și rezultate, e mai bine să încarci doar acelea decât să încarci 400 de pagini și să speri că atenția modelului ajunge acolo unde trebuie.
  • Elimină datele personale de care nu ai nevoie. Numele, adresele de email și identificatorii sunt rareori necesari pentru analiză, iar eliminarea lor e mai rapidă decât să decizi dacă aveai voie să le încarci.
  • Verifică dacă un PDF conține de fapt text. Încearcă să selectezi text în cititorul tău de PDF. Dacă nu poți, e o scanare, Whizi îl va transcrie printr-o trecere de recunoaștere vizuală, iar cifrele merită verificate comparativ cu originalul.

Alegerea modelului potrivit pentru fișier

Această alegere contează mai mult decât promptul atunci când lucrezi cu documente.

  • Gemini pentru orice e lung. Modelele Gemini din Whizi au o fereastră de context de 1.000.000 de tokeni, ceea ce înseamnă că un raport de 200 de pagini, un set complet de contracte sau o duzină de lucrări pot fi prezente deodată, în loc să fie procesate pe bucăți. Întrebările care leagă mai multe documente funcționează corect doar când totul se află cu adevărat în context.
  • Claude pentru nuanță. Limbaj juridic, documente de politici, orice unde sensul depinde de calificări și nuanțări. E și cel mai bun la a-ți spune ce nu spune un document, ceea ce este adesea întrebarea reală.
  • GPT pentru extragere. Facturi, formulare, date structurate, orice unde vrei înapoi un tabel strict sau JSON și denumiri de câmpuri consistente pe sute de rânduri.
  • Orice model multimodal pentru imagini, grafice, capturi de ecran și diagrame. Cere-i să descrie ce vede înainte să-i ceri să interpreteze, ceea ce prinde din timp citirile greșite.

Poți schimba modelele în mijlocul conversației fără să reîncarci fișierul, ceea ce e chiar rostul de a face asta într-un singur spațiu de lucru. Citește cu Gemini, extrage cu GPT și lasă-l pe Claude să scrie rezumatul, toate pe același fișier atașat. Vezi schimbarea modelelor în mijlocul conversației.

Lucrul cu mai multe documente deodată

Întrebările despre un singur document sunt utile. Întrebările despre mai multe documente sunt momentul în care asta încetează să mai fie o comoditate și devine o capacitate pe care nu o aveai înainte.

Prompt: compară

Compară contract-a.pdf și contract-b.pdf. Returnează un tabel cu fiecare clauză care diferă: clauza, ce spune A, ce spune B, și care variantă ne e mai favorabilă și de ce. Ignoră diferențele de formatare și numerotare. Enumeră separat clauzele prezente într-un document și absente din celălalt.

Prompt: consolidează

În toate fișierele atașate, construiește un singur tabel care răspunde la [întrebare]. Un rând per document, cu numele documentului în prima coloană. Acolo unde un document nu abordează subiectul, scrie NEABORDAT. Nu combina documente care folosesc definiții diferite fără să semnalezi asta.

Prompt: găsește contradicția

Unde se contrazic aceste documente între ele? Citează ambele pasaje alăturat și numește fișierul din care provine fiecare. Distinge contradicțiile reale de diferențele de sferă sau de dată.

Referă-te mereu la fișiere pe nume în prompt, odată ce sunt mai multe de unul. "În contractul cu furnizorul, care e perioada de preaviz?" este lipsit de ambiguitate; "care e perioada de preaviz?" îl obligă pe model să aleagă, și nu îți va spune pe care l-a ales.

Când răspunsul pare greșit

O secvență scurtă de diagnostic care rezolvă majoritatea problemelor.

Modelul spune că nu poate vedea fișierul. Confirmă că atașamentul chiar s-a încărcat, apoi referă-te explicit la el: "În raportul atașat report.pdf". Mai ales pentru imagini, formularea "uită-te la imaginea atașată" asigură că se folosește calea multimodală, nu ca modelul să răspundă doar din textul întrebării tale.

Răspunsul e despre documentul greșit. Numește fișierul în fiecare întrebare odată ce conversația are mai multe.

Numerele sunt ușor greșite pe un document scanat. Aceasta e transcrierea scanării, nu raționamentul. Cere-i modelului să citeze textual rândul din jur ca să vezi ce a citit, apoi verifică originalul.

A ratat ceva ce știi că se află acolo. Pune întâi o întrebare de localizare: Citează pasajul care discută [subiect] și dă-i pagina sau secțiunea. Dacă nu-l găsește, extragerea e problema, nu raționamentul. Încearcă un alt model sau încarcă separat paginile relevante.

Rezumă în loc să răspundă. Cere dovada, nu concluzia: Citează textul exact care susține răspunsul tău. Asta prinde și cazul în care răspunsul a fost dedus din cunoștințe generale, nu din documentul tău, ceea ce e cea mai importantă greșeală de prins.

Această ultimă verificare merită subliniată. Un model întrebat despre un tip de contract bine cunoscut, o reglementare comună sau o lucrare celebră poate răspunde plauzibil din datele de antrenament fără să consulte deloc fișierul tău. Cerința unui citat forțează răspunsul să fie ancorat în documentul aflat de fapt în fața lui.

Confidențialitate și ce merită gândit înainte de a încărca

Atașamentele încărcate sunt configurate să expire după cel mult 30 de zile, iar tu poți șterge singur un fișier sau o conversație întreagă mai devreme. Whizi nu folosește prompturile, fișierele, conversațiile, transcrierile vocale sau conținutul generat de tine pentru a antrena modele AI deținute de Whizi și nu vinde acest conținut ca date de antrenament. Furnizorul care rulează modelul ales primește ce îi trebuie pentru a răspunde și poate păstra cache-uri temporare conform propriei politici.

Judecata care rămâne a ta este dacă documentul e unul pe care ai voie să-l procesezi cu un serviciu terț. Categoriile la care merită să te oprești: date personale aparținând altor persoane, orice acoperit de o clauză specifică de confidențialitate, informații materiale nepublice și date reglementate precum înregistrări medicale sau financiare, supuse unor reguli speciale de manipulare.

Calea practică de mijloc pentru majoritatea oamenilor este să redactezi, nu să te abții. Nume înlocuite cu roluri, cifre indexate în loc de absolute și identificatori eliminați vor păstra tot ce are nevoie analiza, eliminând în același timp majoritatea a ceea ce face un document sensibil.

Listă de verificare
  • Denumește fișierele descriptiv, pentru că modelul vede numele fișierului
  • Verifică dacă un PDF are text sau e o scanare înainte să te bazezi pe numerele extrase
  • Încarcă foaia de calcul sursă, nu versiunea formatată pentru prezentare
  • Alege Gemini pentru fișiere lungi, Claude pentru nuanță, GPT pentru extragere
  • Referă-te la fișiere pe nume odată ce e atașat mai mult de unul
  • Cere un citat justificativ ca răspunsurile să rămână ancorate în document
  • Elimină datele personale de care nu ai nevoie pentru analiză

Întrebări frecvente

Sunt private fișierele mele încărcate?

Fișierele încărcate sunt stocate în contul tău, sunt configurate să expire după cel mult 30 de zile și pot fi șterse mai devreme oricând dorești. Whizi nu folosește prompturile, fișierele, conversațiile, transcrierile vocale sau conținutul generat de tine pentru a antrena modele AI deținute de Whizi și nu vinde acest conținut ca date de antrenament. Ce rămâne decizia ta este dacă un anumit document e unul pe care ai voie să-l trimiți către un serviciu terț, lucru de obicei guvernat de propriile tale contracte sau politici interne, nu de ale noastre.

Care e dimensiunea maximă a unui fișier?

Fiecare fișier e limitat la 10 MB, iar un mesaj poate purta până la 6 fișiere. În aceste limite, constrângerea obligatorie e fereastra de context a modelului: pentru contracte lungi, rapoarte și seturi de mai multe documente, alege un model cu context mare, precum Gemini, sau încarcă doar secțiunile relevante în loc de tot fișierul, întrucât un context țintit produce oricum de obicei un răspuns mai bun.

Pot șterge un fișier după ce am discutat despre el?

Da, fișierele pot fi eliminate oricând, iar fișierele încărcate pe care le lași în pace sunt configurate să expire singure după cel mult 30 de zile. Reține că eliminarea unui fișier nu șterge retroactiv ce a fost deja discutat în conversație, deci dacă conținutul e suficient de sensibil pentru a justifica ștergerea fișierului, șterge și conversația.

Funcționează cu PDF-uri scanate?

Da. Whizi detectează un PDF încărcat cu imagini sau scanat după cât de puțin text produc paginile sale și îl trimite o singură dată printr-o trecere de recunoaștere vizuală pe server, care returnează o transcriere pe pagină. Acuratețea e mare pe scanări curate și scade cu rezoluție mică, fonturi neobișnuite, scris de mână și tabele complexe. Deoarece un caracter citit greșit într-un număr e invizibil într-un răspuns fluent, verifică orice cifră dintr-un document scanat comparativ cu originalul.

Pot încărca mai multe documente în aceeași conversație?

Da, și acolo se află cea mai mare parte a valorii. Compararea a două contracte clauză cu clauză, consolidarea concluziilor dintr-un set de rapoarte sau găsirea contradicțiilor între documente sunt toate lucruri care necesită ca totul să fie în context deodată. Referă-te la fișiere pe nume în prompturile tale odată ce sunt mai multe de unul, altfel modelul alege în locul tău fără să spună pe care l-a ales.