Svennis AI
11 Min. Lesezeit

Rechnungen und Verträge mit Claude verarbeiten und sicher in Zoho übernehmen

Claude liest Eingangsrechnungen als JSON nach Ihrem Schema und prüft Verträge mit Seitenangaben. Der Leitfaden zeigt Grenzen, Kosten, Datenweg und die Stellen, an denen eine Person freigibt.

Abstrakte Komposition aus gestapelten Rechtecken, die in geordnete Linien übergehen und an einem Prüfpunkt anhalten

Rechnungen und Verträge mit Claude verarbeiten: zwei getrennte Aufrufe und eine menschliche Freigabe

Rechnungen und Verträge mit Claude verarbeiten gelingt am zuverlässigsten in zwei getrennten Aufrufen. Rechnungen liest Claude über Structured Outputs als JSON nach Ihrem eigenen Schema aus. Verträge prüft Claude mit Zitaten, die auf die Seite im PDF verweisen. Bevor ein Beleg in Zoho gebucht wird, gibt eine Person die Summen frei.

Dokumentverarbeitung mit Claude ist in diesem Leitfaden der Ablauf, in dem ein Modell ein PDF liest, die relevanten Angaben strukturiert zurückgibt und diese Angaben nach einer Prüfung in ein Geschäftssystem übernommen werden. Das Zielsystem für Eingangsrechnungen ist hier Zoho Books. Für Verträge kann das Zoho Contracts sein oder schlicht eine Akte mit den geprüften Kernpunkten.

Die Trennung in zwei Aufrufe folgt aus der Technik. Anthropic dokumentiert, dass Structured Outputs und Citations nicht in derselben Anfrage kombiniert werden können. Eine Anfrage mit beiden Funktionen endet mit einem Fehler 400. Extraktion und belegte Prüfung sind deshalb zwei Schritte mit zwei unterschiedlichen Zielen.

Die menschliche Freigabe folgt aus der Genauigkeit. Sprachmodelle können laut Anthropic Text erzeugen, der sachlich falsch ist oder nicht zum gelieferten Dokument passt. Die Techniken in diesem Leitfaden senken dieses Risiko, sie beseitigen es nicht. Wo ein Fehler Geld kostet, also bei Beträgen, Steuern und Vertragsfristen, prüft deshalb ein Mensch.

Rechnungen laufen als JSON nach Zoho Books, Verträge mit Seitenbelegen zur Prüfung. Rechnungen / Verträge. Funktion: Structured Outputs / Citations; Ergebnis: JSON nach eigenem Schema / Aussagen mit Seitenangabe im PDF; Prüfung durch Person: Summen,

Wie Claude ein PDF liest: jede Seite als Bild und als extrahierter Text

Claude verarbeitet jede PDF-Seite doppelt: Das System wandelt die Seite in ein Bild um und extrahiert zusätzlich ihren Text. Beides erhält das Modell zusammen. Dadurch kann Claude Fragen zu Text, Bildern, Diagrammen und Tabellen im PDF beantworten, etwa zu einer Positionstabelle auf einer Rechnung.

Diese Doppelung hat zwei Folgen für Sie. Erstens stützt sich die PDF-Unterstützung auf Claudes Bildverarbeitung und hat deshalb dieselben Einschränkungen wie andere Bildaufgaben. Ein schlecht eingescannter Beleg bleibt ein Risiko. Zweitens zahlen Sie für jede Seite den Textanteil und den Bildanteil, dazu gleich mehr im Kostenabschnitt.

Was ein PDF mitbringen muss

Das PDF muss ein Standard-PDF ohne Passwort und ohne Verschlüsselung sein. Lieferanten, die ihre Rechnungen schützen, liefern Ihnen also Dokumente, die Sie vorher entsperren müssen. Übergeben können Sie das PDF auf drei Wegen: als URL zu einer online abgelegten Datei, als base64-kodierten Inhalt oder über eine file_id aus der Files API.

Andere Dateiformate

Bei Formaten wie DOCX, ODT oder RTF extrahiert Claude nur den Text. Eingebettete Bilder in solchen Dateien kann Claude nicht lesen. Ein Vertrag als Word-Datei mit eingescannter Unterschriftenseite verliert diese Seite also. Wenn Bilder oder Stempel zählen, übergeben Sie das Dokument als PDF.

Alle aktuell aktiven Claude-Modelle unterstützen die PDF-Verarbeitung. Welches Modell Sie wählen, entscheidet daher eher über Kosten und Seitengrenzen als über die Frage, ob PDFs überhaupt gelesen werden.

Grenzen für PDFs in der Claude API und in den Claude-Apps im Vergleich

Die Grenzen für Dateigröße und Seitenzahl hängen davon ab, ob Sie über die API arbeiten oder in den Claude-Apps. Die API ist der Weg für automatisierte Abläufe mit Zoho. Der Chat eignet sich für Einzelfragen und für das Ausprobieren eines Schemas.

GrenzeClaude APIChat in den Claude-AppsProjektdateien
Größe32 MB pro Anfrage (je nach Plattform)500 MB pro Datei30 MB pro Datei
Menge600 Seiten pro Anfrage, 100 bei einem Kontextfenster unter 1 Mio. Tokensbis zu 20 Dateien pro Chat, PDFs bis 1.000 Seitenbeliebig viele, solange alles ins Kontextfenster passt
Visuelle Analysejede Seite als Bild und Textbis 100 Seiten Text und Bild, 101 bis 1.000 Seiten nur Textnur Textextraktion, außer bei multimodalen PDFs

Die Grenzen der API gelten für die gesamte Anfrage, einschließlich aller anderen Inhalte neben dem PDF. Ein langer Systemprompt zählt also mit. Ein PDF mit mehr als 1.000 Seiten lehnt der Chat mit der Meldung „Uploaded file is too large“ ab.

Die Seitengrenze der API hängt am Modell. Claude Opus 5.5, Claude Sonnet 5 und Claude Fable 5.1 haben ein Kontextfenster von 1 Mio. Tokens. Claude Haiku 4.5 hat 200.000 Tokens und fällt damit unter die Grenze von 100 Seiten pro Anfrage. Für Rechnungen mit zwei Seiten spielt das keine Rolle, für einen umfangreichen Rahmenvertrag schon.

Die API nimmt 600 Seiten und 32 MB je Anfrage, der Chat PDFs bis 1.000 Seiten und 500 MB: API: Seiten je Anfrage 600 Seiten, API: Größe je Anfrage 32 MB, Chat: Seiten je PDF 1000 Seiten, Chat: Größe je Datei 500 MB
Quelle: platform.claude.com, support.claude.com

Rechnungsdaten mit Structured Outputs als JSON nach eigenem Schema auslesen

Structured Outputs ist eine Funktion der Claude API, die Claudes Antwort auf ein von Ihnen definiertes Schema beschränkt. Das Ergebnis ist gültiges JSON, das Ihre Software ohne Nacharbeit weiterverarbeiten kann. Es gibt zwei Varianten: JSON-Ausgaben über output_config.format und die strikte Werkzeugnutzung über strict: true.

Für eine Eingangsrechnung genügen meist diese Felder:

  • Lieferant und USt-IdNr.
  • Rechnungsnummer und Rechnungsdatum
  • Positionen mit Beschreibung, Menge, Einzelpreis, Nettobetrag und Steuersatz
  • Nettosumme, Steuerbetrag, Bruttosumme und Währung
  • ein Feld für Angaben, bei denen Claude unsicher ist

Das letzte Feld ist bewusst gewählt. Anthropic schreibt, dass die ausdrückliche Erlaubnis, Unsicherheit zuzugeben, falsche Angaben drastisch reduzieren kann.

Was das Schema garantiert und was nicht

Structured Outputs garantiert die Form, nicht die Richtigkeit der Werte. Die Einhaltung des Schemas erreicht Anthropic über eingeschränkte Dekodierung. Ob die Bruttosumme stimmt, prüft das Schema nicht. Zahlenregeln wie minimum oder maximum und Längenregeln für Texte werden gar nicht unterstützt. Solche Prüfungen gehören in Ihren eigenen Code.

Weitere Punkte aus der Dokumentation betreffen den Alltag direkt. Die Groß- und Kleinschreibung von Aufzählungswerten ist nicht garantiert, normalisieren Sie also etwa „EUR“ selbst. Über alle Schemas einer Anfrage sind höchstens 24 optionale Felder erlaubt. Die erste Nutzung eines Schemas dauert länger, weil die Grammatik kompiliert wird, danach bleibt sie 24 Stunden ab letzter Nutzung zwischengespeichert.

Lehnt Claude eine Anfrage ab, kommt der Status 200 mit stop_reason: "refusal", und die erzeugten Tokens werden berechnet. Ihr Ablauf muss diesen Fall erkennen.

Verträge mit Citations prüfen: jede Aussage mit Seitenangabe belegt

Citations ist die Funktion der Claude API, mit der jede Aussage in Claudes Antwort auf die Stelle im Dokument verweist, aus der sie stammt. Bei PDFs enthält jedes Zitat den Seitenbereich, gezählt ab Seite 1. Damit eignet sich Citations für die Vertragsprüfung: Die prüfende Person liest nicht den ganzen Vertrag, sondern die belegten Stellen.

Technisch zerlegt Claude PDFs und Klartext in Sätze. Jedes Zitat kann einen Satz oder mehrere aufeinanderfolgende Sätze umfassen. Das Feld cited_text zählt nicht zu den Ausgabe-Tokens. Das Aktivieren von Citations erhöht die Eingabe-Tokens leicht, weil ein zusätzlicher Systemprompt und die Zerlegung hinzukommen.

Drei Einschränkungen, die Sie kennen sollten

  • Gescannte PDFs ohne extrahierbaren Text sind nicht zitierbar. Prüfen Sie vorab, ob sich im Vertrag Text markieren lässt.
  • Citations müssen für alle oder für keines der Dokumente einer Anfrage aktiviert sein.
  • Citations und Structured Outputs schließen sich in einer Anfrage aus.

Lange Verträge zuerst zitieren lassen

Für Dokumente über 20.000 Tokens empfiehlt Anthropic, Claude zuerst wörtliche Zitate herausziehen zu lassen und erst dann die Aufgabe zu stellen. Das bindet die Antwort an den tatsächlichen Text. Zusätzlich können Sie Claude anweisen, nur Informationen aus dem Vertrag zu verwenden und kein Allgemeinwissen. Nach der Antwort lässt sich jede Aussage erneut prüfen: Findet Claude kein stützendes Zitat, muss die Aussage zurückgenommen werden.

Ein Vertrag mit zehn Seiten liegt nach den Angaben zu 1.500 bis 3.000 Text-Tokens pro Seite bereits bei 15.000 bis 30.000 Tokens. Die Zitat-zuerst-Methode lohnt sich also schon bei mittleren Verträgen.

Menschliche Prüfung vor der Übernahme in Zoho: Summen, Fristen, Schreibrechte

Eine Halluzination ist Text, den ein Sprachmodell erzeugt und der sachlich falsch ist oder dem gelieferten Kontext widerspricht. Anthropic beschreibt mehrere Techniken, die solche Fehler seltener machen. Keine davon macht eine Prüfung durch einen Menschen überflüssig, wenn die Angabe in der Buchhaltung oder in einer Vertragsakte landet.

Vor jeder Buchung in Zoho Books prüft eine Person bei Rechnungen diese Punkte:

  • Die Summe der Positionen ergibt die Nettosumme.
  • Nettosumme und Steuerbetrag ergeben die Bruttosumme.
  • Lieferant und USt-IdNr. stimmen mit dem Stammsatz in Zoho Books überein.
  • Die Rechnungsnummer ist dort noch nicht erfasst.
  • Das Feld für unsichere Angaben ist leer oder geklärt.

Die ersten vier Punkte kann Ihr Code vorab rechnen und markieren. Die Freigabe selbst bleibt bei der Person. Bei Verträgen prüft eine fachkundige Person jede zitierte Stelle zu Laufzeit, Kündigung, Haftung und Preisanpassung.

Lesen und Schreiben trennen

Ein Lieferanten-PDF ist fremder, nicht vertrauenswürdiger Inhalt. Es kann Anweisungen enthalten, die das Modell zu einer ungewollten Handlung verleiten sollen, sogenannte Prompt Injection. Bei Svennis trennen wir deshalb den Schritt, der das PDF liest, vom Schritt, der in Zoho Books schreibt: Der lesende Schritt hat keine Schreibrechte, und gebucht wird erst nach der Freigabe durch eine Person.

Wenn Sie später Claude direkt an Zoho anbinden, gelten dieselben Regeln für Rechte und Freigaben. Wie das bei einem CRM aussieht, zeigt der Beitrag Claude mit Zoho CRM über MCP verbinden.

Durchgerechnetes Beispiel: ein Monat Eingangsrechnungen und ein Rahmenvertrag

Das Beispiel zeigt einen Betrieb mit 120 Eingangsrechnungen im Monat, jede mit zwei Seiten, und einem neuen Rahmenvertrag mit einem Lieferanten. Die Mengen sind angenommen, alle technischen Werte stammen aus der Dokumentation von Anthropic.

Teil 1: die Rechnungen des Monats

  1. Sie sammeln die PDFs und sortieren passwortgeschützte Dateien aus.
  2. Sie senden alle Rechnungen als eine Message Batch mit Ihrem Rechnungsschema in output_config.format. Jede Anfrage erhält eine custom_id, etwa RE-2026-10-0117. Erlaubt sind 1 bis 64 Zeichen aus Buchstaben, Ziffern, Bindestrichen und Unterstrichen.
  3. Sie fragen processing_status ab, bis der Wert von in_progress auf ended wechselt. Die meisten Batches sind in weniger als einer Stunde fertig.
  4. Ihr Code gleicht jedes JSON mit Zoho Books ab und markiert Abweichungen.
  5. Eine Person gibt frei, erst dann entsteht die Buchung.

Der Textanteil liegt bei 240 Seiten und 1.500 bis 3.000 Tokens pro Seite bei 360.000 bis 720.000 Eingabe-Tokens. Mit Claude Sonnet 5 im Batch zu 1 US-Dollar pro Million Eingabe-Tokens sind das 0,36 bis 0,72 US-Dollar. Hinzu kommen die Seitenbilder und die Ausgabe-Tokens.

Teil 2: der Rahmenvertrag

  1. Sie senden den Vertrag als PDF mit aktivierten Citations, ohne Schema.
  2. Sie fragen Klausel für Klausel: Laufzeit, Kündigungsfrist, Haftung, Preisanpassung, Gerichtsstand.
  3. Jede Antwort nennt die Seiten, auf denen die Klausel steht.
  4. Die zuständige Person liest die zitierten Stellen und bestätigt oder korrigiert.

Da Sie denselben Vertrag mehrfach befragen, lohnt sich hier Prompt Caching. Der Vertrag wird einmal zwischengespeichert, jede weitere Frage liest ihn zu einem Bruchteil des Preises.

Ein Batch ist meist in unter 1 Stunde fertig, die Ergebnisse bleiben 29 Tage abrufbar: Meiste Batches fertig in unter 1 Stunde, Ergebnisse abrufbar nach Anlage 29 Tage, Text Tokens je PDF Seite 1500-3000 Tokens
Quelle: platform.claude.com

Kosten für Rechnungen und Verträge: Tokenpreise, Batch-Rabatt und Prompt Caching

Für PDFs berechnet Anthropic keine eigene Gebühr, es gelten die normalen API-Preise. Ein Token ist die Einheit, in der Anthropic Ein- und Ausgabe abrechnet. Pro Seite fallen typischerweise 1.500 bis 3.000 Text-Tokens an, je nach Textdichte. Weil jede Seite auch als Bild verarbeitet wird, kommen die Kosten für Bilder hinzu.

ModellEingabe pro Mio. TokensAusgabe pro Mio. TokensEingabe im BatchAusgabe im Batch
Claude Opus 5.54 USD20 USD2 USD10 USD
Claude Sonnet 52 USD10 USD1 USD5 USD
Claude Haiku 4.51 USD5 USD0,50 USD2,50 USD

Batch API für Belege, die warten können

Die Message Batches API verarbeitet viele Anfragen asynchron und berechnet dafür 50 Prozent der normalen Preise. Eine Batch fasst bis zu 100.000 Anfragen oder 256 MB. Batches verfallen, wenn sie nicht innerhalb von 24 Stunden fertig sind, und die Ergebnisse stehen 29 Tage bereit. Fehlerhafte, abgebrochene und verfallene Anfragen werden nicht berechnet. Beachten Sie, dass Batches das Ausgabenlimit eines Workspace leicht überschreiten können.

Prompt Caching für wiederholte Fragen

Prompt Caching speichert einen gleichbleibenden Teil der Anfrage zwischen, etwa den Vertrag. Der Cache lebt standardmäßig fünf Minuten und verlängert sich bei jeder Nutzung kostenlos. Das Schreiben kostet 25 Prozent mehr als normale Eingabe, das Lesen meist 10 Prozent des Eingabepreises. Unterhalb einer Mindestlänge wird nicht gecacht: 512 Tokens bei Claude Opus 5.5, 1.024 bei Claude Sonnet 5, 4.096 bei Claude Haiku 4.5. Batch-Rabatt und Caching lassen sich kombinieren.

Wer unsicher ist, beginnt laut Anthropic mit Claude Opus 5.5. Wann sich das lohnt, beschreibt der Beitrag Claude Opus 5.5 im Unternehmen. Für einfache Belege lohnt der Blick auf Claude Haiku 4.5 als günstige Option, das Anthropic nicht vor dem 15. Oktober 2026 abkündigt.

Datenweg und Speicherort bei Claude: was deutsche Unternehmen klären sollten

Rechnungen und Verträge enthalten Namen, Bankdaten und Konditionen, deshalb zählt der Datenweg. Auf der Claude Platform steuern zwei unabhängige Einstellungen, wo Daten verarbeitet werden. Der Inference Geo legt fest, wo das Modell rechnet. Der Workspace Geo legt fest, wo Daten gespeichert werden und wo etwa die Bildumwandlung läuft.

Standard beim Inference Geo ist „global“, die Verarbeitung kann also in jeder verfügbaren Region laufen. Alternativ lässt sich „us“ wählen, das kostet das 1,1-Fache des Normalpreises. Als Workspace Geo gibt es derzeit nur „us“, und er lässt sich nach dem Anlegen nicht mehr ändern. Eine eigene EU- oder UK-Option bietet Anthropic in der Dokumentation nicht an. Auf Claude Haiku 4.5 wird der Parameter inference_geo nicht unterstützt und führt zu einem Fehler 400.

Aufbewahrung

Zero Data Retention (ZDR) ist eine Vereinbarung, bei der Anthropic Prompts und Antworten nach der API-Antwort nicht speichert. ZDR gibt es auf Absprache und je Organisation. Die Claude-Apps für Teams und Enterprise sowie die Claude Console sind davon nicht erfasst. Für die Batch-Verarbeitung nennt Anthropic eine Aufbewahrung von 29 Tagen. Auch mit ZDR kann Anthropic Daten behalten, wenn das Gesetz es verlangt oder die Sicherheitssysteme eine Sitzung markieren, dann bis zu zwei Jahre.

Über Amazon Bedrock oder Google Cloud ist der Cloud-Anbieter der Auftragsverarbeiter, mit eigener regionaler Preisgestaltung. Welche vertraglichen Schritte die DSGVO verlangt, erläutert der Beitrag Claude DSGVO-konform nutzen. Für die steuerliche Seite von Rechnungen lohnt der Beitrag E-Rechnung und KI nach § 14 UStG.

Nächste Schritte: mit einer Belegart beginnen, Freigabe festlegen, dann erweitern

Der sichere Einstieg in die Dokumentverarbeitung mit Claude ist eine einzige Belegart mit klarer Freigabe. Erweitern Sie erst, wenn diese Belegart stabil läuft. So gehen Sie konkret vor:

  1. Datenweg klären. Entscheiden Sie zwischen Claude Platform, Amazon Bedrock oder Google Cloud und prüfen Sie Aufbewahrung und Auftragsverarbeitung, bevor echte Rechnungen fließen.
  2. Schema entwerfen. Legen Sie die Felder fest, die Zoho Books tatsächlich braucht, und ergänzen Sie ein Feld für unsichere Angaben.
  3. Mit echten Belegen testen. Nehmen Sie zwanzig abgeschlossene Rechnungen aus dem Vormonat, deren richtige Werte Sie kennen, und vergleichen Sie das JSON Feld für Feld.
  4. Prüfregeln programmieren. Lassen Sie Ihren Code Positionssummen, Bruttosumme, USt-IdNr. und doppelte Rechnungsnummern prüfen, bevor eine Person den Beleg sieht.
  5. Rechte trennen. Der Schritt, der PDFs liest, erhält keinen Schreibzugriff auf Zoho Books. Gebucht wird nur nach Freigabe.
  6. Auf Batch umstellen. Sobald die Ergebnisse stimmen, verarbeiten Sie den Monatsstapel über die Batch API zum halben Preis.
  7. Verträge als zweiten Ablauf ergänzen. Aktivieren Sie Citations, stellen Sie feste Fragen zu den wichtigen Klauseln und lassen Sie jede zitierte Stelle von der zuständigen Person bestätigen.

Der wichtigste Einzelschritt ist der erste: Solange der Datenweg nicht geklärt ist, gehören keine echten Rechnungen und Verträge in das Modell. Beginnen Sie deshalb mit dem Beitrag Claude DSGVO-konform nutzen: Vertrag, Datenweg und Grenzen und legen Sie danach Schema und Freigabe fest.

Quellen

  1. 1. PDF support - Claude Platform Docs
  2. 2. Structured outputs - Claude Platform Docs
  3. 3. Citations - Claude Platform Docs
  4. 4. Batch processing - Claude Platform Docs
  5. 5. Prompt caching - Claude Platform Docs
  6. 6. Upload files to Claude - Claude Help Center
  7. 7. Reduce hallucinations - Claude Platform Docs
  8. 8. Data residency - Claude Platform Docs
  9. 9. API and data retention - Claude Platform Docs
  10. 10. Models overview - Claude Platform Docs

Verwandte Beiträge