Comment envoyer des documents à l'IA sur Whizi

Réponse rapide

Joignez le fichier dans la zone de saisie, en le glissant ou en cliquant sur le trombone, puis posez votre question. Whizi accepte les PDF, documents Word, feuilles de calcul, images et fichiers de code ou texte brut. Ce que le modèle reçoit varie selon le type: le texte extrait pour les documents, les valeurs des cellules pour les feuilles de calcul, et l'image elle-même pour les images.

Types de fichiers pris en charge, et ce qui se passe réellement pour chacun

Joignez le fichier en le glissant dans la zone de saisie ou en cliquant sur le trombone, puis posez votre question. Ce que le modèle reçoit varie selon le type de fichier, et savoir lequel explique la plupart des résultats surprenants.

TypeExtensionsCe que le modèle reçoit
PDF texte.pdfLe texte extrait, dans l'ordre de lecture, tableaux inclus sous forme de texte
PDF scannés.pdfUne transcription page par page issue d'une analyse visuelle côté serveur
Documents Word.docxLe texte du document, extrait dans votre navigateur
Feuilles de calcul.xlsx, .csvLes valeurs des cellules sous forme de texte, pas les formules actives
Images.png, .jpg, .jpegL'image elle-même, lue par un modèle multimodal
Code et texte brut.py, .js, .ts, .go, .md, .txt et similairesLe contenu du fichier tel quel

Deux conséquences à retenir. D'abord, une feuille de calcul arrive sous forme de valeurs plutôt que comme un classeur fonctionnel, donc le modèle peut lire ce que votre formule a produit mais ne peut pas réexécuter la formule. Ensuite, un PDF scanné est passé par une transcription visuelle plutôt qu'une extraction de texte simple, et une police inhabituelle, une annotation manuscrite ou une numérisation basse résolution peuvent encore produire un caractère mal lu dans un nombre. Vérifiez les chiffres issus de documents scannés par rapport à l'original. Une remarque sur les images: la zone de saisie refuse les fichiers GIF et demande un PNG ou un JPEG à la place.

Préparez le fichier avant de poser une question

Cinq minutes ici évitent une conversation confuse plus tard.

  • Nommez le fichier pour ce qu'il est. Le modèle voit le nom du fichier, et 2025-q3-vendor-contract-acme.pdf lui donne un contexte utile que document(3).pdf n'apporte pas. Cela compte énormément dès que plusieurs fichiers sont dans le fil.
  • Envoyez la source, pas la version de présentation. Pour les feuilles de calcul en particulier, la version avec cellules fusionnées, sous-totaux dans les données et notes en marge cause bien plus d'erreurs qu'un fichier simple mais volumineux.
  • Découpez les documents énormes par objet, pas par taille. Si vous n'avez besoin que des sections méthodologie et résultats, les importer est préférable à importer 400 pages en espérant que l'attention se pose au bon endroit.
  • Retirez les données personnelles dont vous n'avez pas besoin. Les noms, e-mails et identifiants sont rarement nécessaires pour l'analyse, et les retirer est plus rapide que de décider si vous étiez autorisé à les importer.
  • Vérifiez qu'un PDF est réellement du texte. Essayez de sélectionner du texte dans votre lecteur PDF. Si vous ne pouvez pas, c'est un scan, Whizi le transcrira via une analyse visuelle, et les chiffres méritent une vérification par rapport à l'original.

Choisir le modèle adapté au fichier

Ce choix compte plus que le prompt pour le travail sur documents.

  • Gemini pour tout ce qui est long. Les modèles Gemini sur Whizi disposent d'une fenêtre de contexte de 1 000 000 de tokens, ce qui signifie qu'un rapport de 200 pages, un jeu complet de contrats ou une dizaine d'articles peuvent être présents en même temps plutôt que traités par morceaux. Les questions inter-documents ne fonctionnent correctement que lorsque tout est réellement en contexte.
  • Claude pour la nuance. Le langage juridique, les documents de politique, tout ce dont le sens dépend de qualificatifs et de nuances. C'est aussi le meilleur pour vous dire ce qu'un document ne dit pas, ce qui est souvent la vraie question.
  • GPT pour l'extraction. Factures, formulaires, données structurées, tout ce pour quoi vous voulez un tableau ou un JSON strict avec des noms de champs cohérents sur une centaine de lignes.
  • Tout modèle multimodal pour les images, graphiques, captures d'écran et diagrammes. Demandez-lui de décrire ce qu'il voit avant de lui demander d'interpréter, ce qui repère tôt les erreurs de lecture.

Vous pouvez changer de modèle en cours de fil sans réimporter le fichier, c'est tout l'intérêt de faire cela dans un seul espace de travail. Lisez avec Gemini, extrayez avec GPT, et faites rédiger le résumé par Claude, le tout sur le même fichier joint. Voir changer de modèle en cours de conversation.

Travailler avec plusieurs documents à la fois

Les questions sur un seul document sont utiles. Les questions sur plusieurs documents sont là où cela cesse d'être une simple commodité et devient une capacité que vous n'aviez pas auparavant.

Prompt: comparer

Compare contract-a.pdf and contract-b.pdf. Return a table of every clause that differs: clause, what A says, what B says, and which is more favourable to us and why. Ignore differences in formatting and numbering. List clauses present in one and absent from the other separately.

Prompt: consolider

Across all attached files, build one table answering [question]. One row per document, with the document name in the first column. Where a document does not address it, write NOT ADDRESSED. Do not merge documents that use different definitions without flagging it.

Prompt: trouver la contradiction

Where do these documents contradict each other? Quote both passages side by side and name the file each came from. Distinguish genuine contradictions from differences in scope or date.

Référencez toujours les fichiers par leur nom dans votre prompt dès qu'il y en a plus d'un. « Dans le contrat fournisseur, quel est le délai de préavis ? » est sans ambiguïté; « quel est le délai de préavis ? » oblige le modèle à choisir, et il ne vous dira pas lequel il a choisi.

Quand la réponse semble fausse

Une courte séquence de diagnostic qui résout la plupart des problèmes.

Le modèle dit qu'il ne voit pas le fichier. Confirmez que la pièce jointe a bien été importée, puis référencez-la explicitement: « Dans le rapport.pdf joint ». Pour les images en particulier, dire « regarde l'image jointe » garantit que le chemin multimodal est utilisé plutôt que le modèle répondant uniquement à partir du texte de votre question.

La réponse porte sur le mauvais document. Nommez le fichier dans chaque question dès que le fil en contient plusieurs.

Les chiffres sont subtilement faux sur un document scanné. C'est la transcription du scan, pas le raisonnement, qui est en cause. Demandez au modèle de citer la ligne environnante mot pour mot pour voir ce qu'il a lu, puis vérifiez l'original.

Il a manqué quelque chose que vous savez présent. Posez d'abord une question de localisation: Quote the passage that discusses [topic] and give its page or section. S'il ne le trouve pas, c'est l'extraction qui pose problème, pas le raisonnement. Essayez un autre modèle ou importez les pages concernées séparément.

Il résume au lieu de répondre. Demandez la preuve plutôt que la conclusion: Quote the exact text that supports your answer. Cela repère aussi le cas où la réponse a été déduite de connaissances générales plutôt que de votre document, ce qui est l'erreur la plus importante à détecter.

Cette dernière vérification mérite d'être soulignée. Un modèle interrogé sur un type de contrat bien connu, une réglementation courante ou un article célèbre peut répondre de façon plausible à partir de ses données d'entraînement sans consulter votre fichier du tout. Exiger une citation force la réponse à être ancrée dans le document réellement présent.

Confidentialité et ce à quoi penser avant d'importer

Les pièces jointes importées sont configurées pour expirer après 30 jours maximum, et vous pouvez supprimer un fichier ou une conversation entière plus tôt vous-même. Whizi n'utilise pas vos prompts, fichiers, conversations, transcriptions vocales ou contenus générés pour entraîner des modèles d'IA appartenant à Whizi, et ne vend pas ce contenu comme données d'entraînement. Le fournisseur qui exécute le modèle que vous avez sélectionné reçoit ce dont il a besoin pour répondre et peut conserver des caches temporaires selon sa propre politique.

Le jugement qui vous revient est de savoir si le document est de ceux que vous êtes autorisé à traiter avec un service tiers. Les catégories qui méritent réflexion: les données personnelles appartenant à d'autres personnes, tout ce qui est couvert par une clause de confidentialité spécifique, les informations importantes non publiques, et les données réglementées comme les dossiers médicaux ou financiers soumis à des règles de traitement particulières.

La voie médiane pratique pour la plupart des gens est de caviarder plutôt que de s'abstenir. Des noms remplacés par des rôles, des chiffres indexés plutôt qu'absolus, et des identifiants retirés préserveront tout ce dont l'analyse a besoin tout en retirant l'essentiel de ce qui rend un document sensible.

Liste de vérification
  • Nommez les fichiers de façon descriptive, puisque le modèle voit le nom du fichier
  • Vérifiez si un PDF est du texte ou un scan avant de faire confiance aux chiffres extraits
  • Importez la feuille de calcul source, pas la version de présentation mise en forme
  • Choisissez Gemini pour les fichiers longs, Claude pour la nuance, GPT pour l'extraction
  • Référencez les fichiers par leur nom dès qu'il y en a plus d'un joint
  • Demandez une citation à l'appui pour que les réponses restent ancrées dans le document
  • Retirez les données personnelles dont vous n'avez pas besoin pour l'analyse

Questions fréquentes

Mes fichiers importés sont-ils privés ?

Les fichiers importés sont stockés sous votre compte, configurés pour expirer après 30 jours maximum, et peuvent être supprimés plus tôt quand vous le souhaitez. Whizi n'utilise pas vos prompts, fichiers, conversations, transcriptions vocales ou contenus générés pour entraîner des modèles d'IA appartenant à Whizi, et ne vend pas ce contenu comme données d'entraînement. Ce qui reste votre décision est de savoir si un document donné est de ceux que vous êtes autorisé à envoyer à un service tiers, ce qui est généralement régi par vos propres contrats ou politique interne plutôt que par les nôtres.

Quelle est la taille maximale d'un fichier ?

Chaque fichier est plafonné à 10 Mo, et un message peut contenir jusqu'à 6 fichiers. Dans ces limites, la contrainte réelle est la fenêtre de contexte du modèle: pour les contrats longs, les rapports et les ensembles multi-documents, choisissez un modèle à grand contexte comme Gemini, ou importez les sections pertinentes plutôt que le fichier entier, puisqu'un contexte ciblé produit généralement une meilleure réponse de toute façon.

Puis-je supprimer un fichier après avoir discuté ?

Oui, les fichiers peuvent être retirés à tout moment, et les fichiers importés que vous laissez tels quels sont configurés pour expirer d'eux-mêmes après 30 jours maximum. Notez que retirer un fichier n'efface pas rétroactivement ce qui a déjà été discuté dans la conversation, donc si le contenu est assez sensible pour justifier la suppression du fichier, supprimez aussi la conversation.

Cela fonctionne-t-il avec les PDF scannés ?

Oui. Whizi détecte un PDF riche en images ou scanné en fonction de la faible quantité de texte que ses pages produisent, et l'envoie une fois via une analyse visuelle côté serveur qui renvoie une transcription page par page. La précision est élevée sur les scans propres et diminue avec une basse résolution, des polices inhabituelles, de l'écriture manuscrite et des mises en page de tableaux complexes. Comme un caractère mal lu dans un nombre est invisible dans une réponse fluide, vérifiez tout chiffre issu d'un document scanné par rapport à l'original.

Puis-je importer plusieurs documents dans la même conversation ?

Oui, et c'est là que se trouve l'essentiel de la valeur. Comparer deux contrats clause par clause, consolider des constats sur un ensemble de rapports, ou trouver des contradictions entre documents sont toutes des choses qui exigent que tout soit en contexte à la fois. Référencez les fichiers par leur nom dans vos prompts dès qu'il y en a plus d'un, sinon le modèle choisit à votre place sans dire lequel il a choisi.