Daten aus PDFs extrahieren
In diesem Rezept verwandeln Sie einen Stapel Lieferantenverträge in eine strukturierte Tabelle: eine Zeile pro Vertrag, mit Vertragspartner, Startdatum, Vertragswert und einer von der KI extrahierten Risikokategorie — jeder Wert belegt durch ein Zitat, das Sie im Quelldokument öffnen können.
Was Sie brauchen: ein Quanty-Konto mit aktivem Abonnement und ein paar PDF-Verträge auf Ihrem Rechner.
Schritt 1 — Arbeitsmappe erstellen
Klicken Sie im Hauptbereich auf Neue Arbeitsmappe. Vergeben Sie einen Namen wie
Lieferantenverträge (Namen brauchen mindestens 3 Zeichen und müssen in Ihrer
Organisation eindeutig sein), optional eine Beschreibung, und wählen oder generieren Sie
einen Arbeitsmappen-Avatar. Öffnen Sie anschließend die Tabelle der Arbeitsmappe.
Schritt 2 — Verträge als Zeilen hinzufügen
Der schnellste Weg: Ziehen Sie die PDFs direkt auf das Raster — es erscheint der Hinweis, Dateien abzulegen, um Zeilen hinzuzufügen. Jede Datei wird zu einer Zeile in einer Datei-Spalte.
Alternativ klicken Sie in der Werkzeugleiste der Tabelle auf Dateien hinzufügen. Im Dialog wählen Sie Dokumente aus den Dateien (bereits hochgeladen) oder laden neue hoch. Dateien werden nach dem Hochladen analysiert; warten Sie, bis die Verarbeitungsleiste die Zeilen als Fertig zeigt. Schlägt etwas fehl, nutzen Sie die Option, fehlgeschlagene Dateien erneut zu verarbeiten.
Schritt 3 — KI-Spalten hinzufügen
Klicken Sie für jedes Feld, das Sie extrahieren möchten, auf Spalte hinzufügen:
| Spalte | Spaltentyp | Konfiguration |
|---|---|---|
| Vertragspartner | Text | Extraktionstyp Entitäten-Extraktion, Anweisung: welches Unternehmen die Gegenpartei ist |
| Startdatum | Text | Extraktionstyp Datum — findet ein Datum und normalisiert das Format |
| Vertragswert | Zahl | Datenformat Währung mit Ihrem Symbol und Dezimalstellen |
| Risikokategorie | Einfachauswahl | Optionen wie niedrig, mittel, hoch; die KI wählt genau eine |
Für die Vertragspartner-Spalte funktioniert auch eine eigene Anweisung (Custom Prompt) — der flexibelste Typ. Anweisungen dürfen bis zu 1500 Zeichen lang sein, und Sie können das Modell pro Spalte wählen (Economy-, Standard- oder Premium-Stufe).
Schritt 4 — Quellenzitate aktivieren
Aktivieren Sie in den Einstellungen jeder KI-Spalte den Schalter für Quellenzitate (Cite sources). Er ergänzt jeden extrahierten Wert um Seitenverweise (bei etwa 20 % mehr Token-Verbrauch) — genau das macht den Prüfschritt unten möglich.
Schritt 5 — KI starten
Klicken Sie in der Werkzeugleiste auf KI starten. Eine Bestätigung erklärt, dass ausstehende Zellen mit KI verarbeitet werden und dies Tokens aus dem KI-Budget Ihrer Organisation verbraucht — Sie können den Fortschritt verfolgen und jederzeit stoppen (bereits berechnete Werte bleiben erhalten). Zellen durchlaufen Ausstehend, Verarbeitung… und Fertig; Fehler erscheinen als Fehlgeschlagen.
Schritt 6 — Werte gegen die Quelle prüfen
Klicken Sie auf eine fertige Zelle, um die Zellen-Detailansicht zu öffnen. Sie sehen den Wert, die Erklärung Warum dieser Wert, einen Konfidenzwert und Zitate als Seiten-Chips. Ein Klick auf „Im Dokument anzeigen“ springt zur hervorgehobenen Stelle im PDF.
- Genehmigen oder Ablehnen Sie jeden geprüften Wert.
- Ist ein Wert korrekt und darf sich nie ändern, sperren Sie ihn als Referenzwert (Sperren). Spätere Läufe protokollieren Abweichungen, statt ihn zu überschreiben.
- Liegt ein Wert leicht daneben, nutzen Sie Verfeinern mit einer Folgeanweisung,
zum Beispiel
einmalige Einrichtungsgebühren ausschließen.
Schritt 7 — Exportieren
Wenn die Tabelle stimmt, exportieren Sie sie über das Tabellenmenü als CSV oder Excel und teilen sie mit Ihrem Team — oder machen Sie direkt weiter und erstellen ein Deck daraus.
Nächste Schritte
- Spalten & KI-Extraktion — alle Spaltentypen, @-Erwähnungen und Verzweigungen
- Prüfung & Audit-Trail — Freigaben, Referenzwerte und Wiederherstellen
- Dateien & Wissensdatenbank — wie Dokumente verarbeitet und geteilt werden