Wie man online mit einem PDF chattet: Anleitung für Whizi

Kurzantwort

Häng das PDF an, indem du es in das Nachrichtenfeld ziehst oder auf das Büroklammer-Symbol klickst, und stell dann deine Frage in normaler Sprache. Jedes Modell in deinem Plan kann es lesen, und du kannst gegen dieselbe Datei das Modell wechseln, ohne sie erneut hochzuladen. Bitte das Modell, die Textstelle zu zitieren, die es verwendet hat, bevor du dich auf eine Antwort verlässt.

Die kurze Antwort

Zieh das PDF in das Nachrichtenfeld oder klicke auf das Büroklammer-Symbol, um es anzuhängen, und stell dann deine Frage in normaler Sprache. Jedes Modell in deinem Plan kann es lesen, und du kannst gegen dieselbe Datei das Modell wechseln, ohne sie erneut hochzuladen.

Mach eins, bevor du dich auf eine Antwort verlässt: bitte das Modell, die verwendete Textstelle zu zitieren. Eine selbstsichere Antwort aus Trainingsdaten statt aus deiner Datei ist der Fehler, der Menschen Geld kostet, und eine Ortungsfrage entlarvt ihn in etwa zehn Sekunden. Der Rest dieser Seite zeigt, wie man das richtig macht.

Zuerst bestätigen, dass es dein Dokument liest

Der gefährlichste Fehler beim Chatten mit Dokumenten ist nicht eine falsche Antwort, sondern eine selbstsichere Antwort aus Trainingsdaten statt aus deiner Datei. Das passiert am häufigsten bei Dokumenten, die etwas Gängigem ähneln: ein Standardmietvertrag für Gewerbe, eine bekannte Verordnung, eine viel diskutierte Studie. Das Modell kennt das Genre gut genug, um eine plausible Antwort zu erzeugen, ohne deinen konkreten Text zu Rate zu ziehen, und nichts in der Ausgabe zeigt an, dass es das getan hat.

Eine Gewohnheit beseitigt das. Bevor du deine eigentliche Frage stellst, stell eine Ortungsfrage.

Zitiere die Passage im angehängten Dokument, die [Thema] behandelt, und gib die Seite oder den Abschnitt an, in dem sie erscheint. Falls es nicht im Dokument steht, sag das.

Liefert es ein echtes Zitat, liest es deine Datei. Erzeugt es eine allgemeine Umschreibung oder findet es etwas nicht, von dem du weißt, dass es da ist, ist die Extraktion fehlgeschlagen, und jede folgende Antwort ist verdächtig. Das dauert zehn Sekunden und macht den Unterschied zwischen einem Werkzeug und einem Risiko aus.

Trag die Gewohnheit auch in die eigentlichen Fragen: Zitiere den genauen Text, der deine Antwort stützt sollte in jedem Prompt vorkommen, dessen Antwort verlässlich sein muss.

Das richtige Modell für das Dokument wählen

DokumentModellWarum
Berichte mit 100+ Seiten, Einreichungen, ganze VertragswerkeGeminiEin Kontextfenster mit 1.000.000 Token, sodass das Dokument wirklich vollständig vorliegt statt in Stücken
Verträge, Richtlinien, alles, wo Feinheiten zählenClaudeAm stärksten bei Nuancen und dabei zu sagen, was ein Dokument nicht aussagt
Rechnungen, Formulare, kurze strukturierte DateienGPTSchnell und am zuverlässigsten bei strikter Extraktion in Tabellen oder JSON
Studien mit Abbildungen, gescannte Seiten, DiagrammeJedes multimodale ModellLiest die Seite als Bild, wo die Textextraktion versagt

Der Punkt zum Kontextfenster lohnt sich auszuführen. Übersteigt ein Dokument, was ein Modell fassen kann, muss es in Stücken verarbeitet werden, und Fragen, die das ganze Dokument auf einmal brauchen (widerspricht hier etwas Klausel 14, ist dieser Begriff irgendwo definiert, welcher dieser drei Abschnitte ist inkonsistent) werden unzuverlässig. Das ist der konkrete Grund, bei langen Dateien zum Modell mit großem Kontext zu greifen statt aus allgemeiner Vorliebe.

Du kannst Modelle wechseln, ohne erneut hochzuladen, also lies mit dem einen und extrahiere mit dem anderen gegen dieselbe Datei. Siehe Modelle mitten im Gespräch wechseln.

Prompts nach Dokumenttyp

Verträge und Vereinbarungen

Extrahiere aus der angehängten Vereinbarung in eine Tabelle: Laufzeit und Verlängerung, Kündigungsfrist, Zahlungsbedingungen, Haftungsobergrenze, Freistellungen, anwendbares Recht, Abtretung und jede Klausel, die die Kündigung überdauert. Gib für jede die Klauselnummer an und zitiere den operativen Satz. Liste dann getrennt die Pflichten auf, die uns treffen statt der Gegenseite.

Folge mit der Frage nach, die wirklich zählt: Was in dieser Vereinbarung ist ungewöhnlich im Vergleich zu Standardbedingungen für diese Vertragsart, und was fehlt auffällig? Das Fehlende ist meist, wo das Risiko sitzt, und ist das, was eine Stichwortsuche nie findet.

Forschungsarbeiten

Gib für die angehängte Arbeit zurück: die Forschungsfrage, das Studiendesign, Stichprobe und Population, das primäre Ergebnis, das Hauptresultat mit Effektstärke, die genannten Einschränkungen und die Finanzierungsquelle. Sag mir dann die drei Behauptungen dieser Arbeit, die vor einem Zitat unabhängig überprüft werden müssten.

Lange Berichte und Einreichungen

Fasse den angehängten Bericht in 10 Stichpunkten zusammen, geordnet nach Wichtigkeit statt nach Dokumentreihenfolge. Liste dann: die drei Zahlen, die eine Entscheidungsperson interessieren würden, mit Seitenangabe, alles, was der Bericht als Fakt ohne Quelle darstellt, und jede Stelle, an der Zusammenfassung oder Kurzabschnitt später im Dokument den Details widersprechen.

Diese letzte Prüfung findet erstaunlich oft echte Probleme. Kurzfassungen werden früh geschrieben und weniger überarbeitet als die Abschnitte, die sie zusammenfassen.

Zwei Dokumente vergleichen

Vergleiche contract-a.pdf und contract-b.pdf Klausel für Klausel. Gib eine Tabelle mit jedem inhaltlichen Unterschied zurück: Thema, was A sagt, was B sagt und wer davon profitiert. Ignoriere Formatierungs- und Nummerierungsunterschiede. Liste getrennt alles auf, was in einem vorkommt und im anderen fehlt.

In etwas Nutzbares umwandeln

Schreibe die Ergebnisse für ein Führungspublikum in 150 Wörtern um. Beginne mit der erforderlichen Entscheidung. Kein undefinierter Fachjargon. Markiere alles, was ich vor der Weitergabe prüfen sollte.

Fehlerbehebung

"Ich sehe kein Dokument." Bestätige, dass die Datei fertig hochgeladen ist, und verweise dann explizit mit Namen darauf in deiner Nachricht. Bei sehr langen Threads ist erneutes Anhängen oder ein neuer Chat nur mit der Datei schneller als darüber zu streiten.

Gescanntes PDF, verstümmelter oder fehlender Text. Das Dokument ist ein Bild, also hat einfache Textextraktion wenig zu lesen. Whizi erkennt ein bildlastiges PDF daran, wie wenig Text seine Seiten liefern, und schickt es einmal durch einen serverseitigen Bildverarbeitungsdurchlauf, der eine seitenweise Transkription liefert. Die Genauigkeit sinkt bei niedriger Auflösung, ungewöhnlichen Schriften, Handschrift und dichten Tabellen. Weil eine falsch gelesene Ziffer in einer flüssigen Antwort unsichtbar ist, prüfe jede Zahl aus einem gescannten Dokument gegen die Originalseite.

Tabellen kommen falsch heraus. PDF-Tabellen sind darunter notorisch schlecht strukturiert. Bitte zuerst um eine wortgetreue Wiedergabe der Tabelle, prüfe sie gegen die Seite, und erst danach um eine Analyse. Für aufwendige Tabellenarbeit ist ein multimodales Modell, das die Seite als Bild liest, oft zuverlässiger als Textextraktion.

Es hat etwas übersehen, das du weißt, dass es da ist. Stell die Ortungsfrage. Kann das Modell keine Passage zitieren, die du sehen kannst, liegt das Problem bei der Extraktion, nicht beim Schlussfolgern. Probier ein anderes Modell oder lade nur die relevanten Seiten hoch.

Die Datei ist zu groß. Nutze das Modell mit großem Kontext, oder teile nach Zweck statt nach Seitenzahl auf. Die drei tatsächlich benötigten Abschnitte hochzuladen schlägt 400 Seiten hochzuladen und zu hoffen.

Antworten werden im Verlauf des Gesprächs vager. Lange Threads sammeln Kontext an, der mit dem Dokument konkurriert. Starte einen neuen Chat mit der Datei und einer knappen Aussage dessen, was du brauchst.

Prüfen, bevor du dich darauf verlässt

Drei Prüfungen, nach Wichtigkeit geordnet.

Verlange Zitate bei allem Folgenreichen. Eine zitierte Passage ist in Sekunden überprüfbar, eine Umschreibung nicht. Diese eine Praxis beseitigt das meiste Risiko bei der Dokumentarbeit.

Gegenprüfe mit einem zweiten Modell. Stell dieselbe Frage einem anderen Modell gegen dieselbe Datei. Übereinstimmung ist ein aussagekräftiger Beleg, Abweichung sagt dir genau, wo du nachsehen musst. Whizis Nebeneinander-Vergleich existiert genau dafür.

Frag, wobei es sich unsicher ist. Bei welcher deiner Antworten oben bist du dir am wenigsten sicher, und was im Dokument ist mehrdeutig? Modelle sind bei der Selbsteinschätzung unvollkommen, aber die Mehrdeutigkeiten, die sie aufzeigen, sind meist echte Mehrdeutigkeiten in der Quelle, was nützliche Information über das Dokument selbst ist.

Und die feste Regel für alles mit Folgen, also juristisches, finanzielles, medizinisches oder Compliance-Material: das Modell findet die Passage, du triffst das Urteil. Es ist ein Leseassistent, kein Berater, und die Verantwortung für eine Entscheidung, die auf seiner Ausgabe beruht, liegt ganz bei dir.

Checkliste
  • Stell zuerst eine Ortungsfrage, um zu bestätigen, dass das Modell deine Datei liest
  • Verlange ein genaues Zitat für jede folgenreiche Antwort
  • Nutze das Modell mit großem Kontext für lange Dokumente, damit nichts in Stücken verloren geht
  • Frag nach dem, was auffällig fehlt, genauso wie nach dem, was das Dokument sagt
  • Prüfe Zahlen aus gescannten Dokumenten gegen die Originalseite
  • Gib Tabellen wortgetreu wieder und prüfe sie, bevor du sie analysierst
  • Gegenprüfe alles Wichtige mit einem zweiten Modell

Häufige Fragen

Wie groß darf ein PDF maximal sein?

Jede hochgeladene Datei ist auf 10 MB begrenzt, und eine Nachricht kann bis zu 6 Dateien tragen. Innerhalb dessen ist die eigentliche Grenze das Kontextfenster des Modells, nicht das Dateilimit. Gemini in Whizi trägt ein Kontextfenster mit 1.000.000 Token, weshalb es die Empfehlung für lange Berichte, Einreichungen und Mehrvertragswerke ist. Darüber hinaus lade die tatsächlich benötigten Abschnitte hoch statt des gesamten Dokuments, da gezielter Kontext meist auch eine schärfere Antwort liefert.

Speichert Whizi meine PDFs?

Hochgeladene Dateien werden unter deinem Konto gespeichert, sind so eingestellt, dass sie nach bis zu 30 Tagen ablaufen, und können jederzeit früher gelöscht werden. Whizi nutzt deine Prompts, Dateien, Gespräche, Sprachtranskripte oder generierten Inhalte nicht, um Whizi-eigene KI-Modelle zu trainieren, und verkauft diese Inhalte nicht als Trainingsdaten. Das Löschen einer Datei entfernt nicht, was bereits im Gespräch darüber besprochen wurde, also lösch auch den Chat, falls das Dokument sensibel genug ist, um eine Löschung zu rechtfertigen.

Kann ich mit mehreren PDFs gleichzeitig chatten?

Ja, und der Vergleich über Dokumente hinweg ist, wo das am wertvollsten ist. Lade mehrere Dateien in denselben Thread hoch und verweise mit Namen darauf in deinen Prompts, sonst wählt das Modell selbst aus, aus welcher es antwortet, ohne es dir zu sagen. Klausel-für-Klausel-Vertragsvergleich, das Zusammenführen von Ergebnissen über Berichte hinweg und das Finden von Widersprüchen zwischen Dokumenten brauchen alle alles gleichzeitig vorliegend, was ein weiterer Grund ist, das Modell mit großem Kontext zu nutzen.

Funktioniert es mit gescannten PDFs?

Ja. Whizi erkennt ein gescanntes oder bildlastiges PDF daran, wie wenig Text seine Seiten liefern, und transkribiert es seitenweise durch einen serverseitigen Bildverarbeitungsdurchlauf. Die Genauigkeit ist bei sauberen Scans gut und sinkt bei niedriger Auflösung, ungewöhnlichen Schriften, Handschrift und dichten Tabellen. Da ein falsch gelesenes Zeichen eine falsche Zahl innerhalb einer sonst flüssigen Antwort erzeugt, prüfe jede Zahl aus einem gescannten Dokument gegen die Originalseite.

Woher weiß ich, dass die Antwort wirklich aus meinem Dokument stammt?

Verlange ein Zitat. Bitte das Modell, die genaue Passage zu zitieren, die seine Antwort stützt, samt Seite oder Abschnitt, und klar zu sagen, wenn die Information nicht im Dokument steht. Antworten aus Trainingsdaten statt aus deiner Datei sind der gefährlichste Fehler beim Chatten mit Dokumenten, gerade weil sie für gängige Dokumenttypen plausibel wirken, und ein überprüfbares Zitat zu verlangen ist der einzig verlässliche Weg, den Unterschied zu erkennen.