Svennis AI
11 min de citit

Facturi și contracte procesate cu Claude: datele în Zoho, excepțiile la om

Claude poate citi facturile și contractele primite, extrage datele pe o schemă fixă și trimite la un om doar excepțiile. Ghidul arată limitele, costul pe pagină și unde ajung datele.

Forme abstracte de pagini care trec printr-un filtru și se despart în două fluxuri distincte

Facturi și contracte procesate cu Claude: ce preia AI-ul și ce rămâne la om

Facturi și contracte procesate cu Claude înseamnă că modelul citește PDF-ul și extrage datele într-un format fix. Apoi le pregătește pentru Zoho Books sau Zoho CRM. Un om vede doar excepțiile: totaluri care nu se leagă, furnizori necunoscuți, clauze neobișnuite. Nimeni nu mai tastează facturi de mână.

Procesarea documentelor cu Claude este un flux în doi pași. Primul pas extrage date structurate din facturi. Al doilea revizuiește contractele și arată pagina din care vine fiecare răspuns. Cei doi pași sunt apeluri separate, pentru că documentația Anthropic nu permite ambele funcții în aceeași cerere.

Regula de bază rămâne aceeași în tot ghidul. Claude pregătește datele, codul verifică cifrele, iar omul aprobă ce iese din tipar. Nimic nu ajunge în contabilitate fără acest ultim pas.

Mai jos găsești limitele pentru PDF-uri, schema pentru facturi și citările pentru contracte. Urmează un exemplu lucrat, alegerea modelului, costul pe pagină și locul unde ajung datele.

Aplicația Claude sau API-ul: limitele pentru PDF-uri în fiecare

Pentru câteva documente pe săptămână ajunge aplicația Claude. Pentru sute de facturi pe lună ai nevoie de API. API-ul este interfața prin care un program trimite documentele la Claude, fără ca cineva să le încarce manual. Limitele diferă mult între cele trei variante.

VariantăDimensiune maximăPaginiCe analizează
Chat în aplicație500 MB pe fișier, până la 20 de fișiere pe chatPână la 1.000 de pagini pe PDFText și imagini până la 100 de pagini; doar text între 101 și 1.000
Fișiere într-un proiect30 MB pe fișier, număr nelimitatCât încape în fereastra de contextDoar text extras, cu excepția PDF-urilor multimodale
API32 MB pe cerere600 pe cerere; 100 dacă fereastra de context a cererii e sub 1M tokeniFiecare pagină ca imagine, plus textul extras

Pe API, sistemul transformă fiecare pagină în imagine și extrage textul paginii, pe care îl trimite alături de imagine. Așa Claude vede și tabelul cu linii, și textul. PDF-ul trebuie să fie standard, fără parolă sau criptare. Limitele de dimensiune și de pagini privesc întreaga cerere, inclusiv alt conținut trimis odată cu PDF-ul.

Fereastra de context este cantitatea maximă de text, măsurată în tokeni, pe care modelul o ia în calcul într-o cerere. Un token este o bucată de cuvânt. Dacă echipa ta lucrează deja în aplicație, ghidul despre Claude Cowork în firmă arată cum organizezi munca acolo.

Pe API trimiți cel mult 600 de pagini și 32 MB într-o cerere, iar sub 1M context doar 100 de pagini: Dimensiune maximă pe cerere API 32 MB, Pagini pe cerere API 600 pagini, Pagini pe cerere, context sub 1M 100 pagini, Pagini pe PDF încărcat în chat 1
Sursa: platform.claude.com, support.claude.com

Extragerea datelor din facturi în JSON cu structured outputs

Structured outputs este funcția care obligă Claude să răspundă într-un JSON ce respectă o schemă definită de tine. JSON este un format de date pe care orice program îl poate citi. Pentru facturi, schema fixează câmpurile, iar răspunsul are mereu aceeași formă.

Documentația Anthropic spune că structured outputs garantează răspunsuri conforme cu schema. Funcția se activează cu parametrul output_config.format. O schemă de factură poate conține aceste câmpuri:

  • denumirea furnizorului;
  • codul de TVA al furnizorului, ca text, exact cum apare pe factură;
  • numărul și data facturii;
  • liniile: descriere, cantitate, preț unitar, valoare;
  • totalul fără TVA, TVA-ul și totalul de plată.

Schema garantează forma, nu corectitudinea valorilor. Constrângerile numerice, precum minimum sau maximum, nu sunt suportate. Nici limitele de lungime ale textului nu sunt. Verificarea că liniile adunate dau totalul o face codul tău, după răspuns.

Valorile dintr-o listă fixă (enum) nu au majusculele garantate, deci compară-le fără să ții cont de ele. Prima folosire a unei scheme vine cu o întârziere, cât se compilează gramatica. Gramatica rămâne apoi în cache 24 de ore de la ultima folosire. Dacă Claude refuză o cerere din motive de siguranță, răspunsul are stop_reason „refusal”, iar tokenii se plătesc. Tratează acest caz ca excepție.

Revizuirea contractelor cu citări pe pagină, într-un apel separat

Pentru contracte, funcția potrivită este Citations: fiecare răspuns al lui Claude arată pagina din care provine. La PDF-uri, citarea include intervalul de pagini, numerotat de la 1. Un manager poate deschide pagina și verifica fraza în câteva secunde.

Citations și structured outputs nu merg în aceeași cerere. Dacă activezi citările împreună cu output_config.format, API-ul întoarce eroare 400. De aceea extragerea facturilor și revizuirea contractelor sunt două apeluri distincte.

Trei limite ale citărilor contează în practică:

  • Un PDF scanat, fără text extractibil, nu poate fi citat.
  • Citările se activează pe toate documentele dintr-o cerere sau pe niciunul.
  • Sunt suportate doar citări din text, nu din imagini.

Citările cresc puțin tokenii de intrare, din cauza promptului de sistem și a împărțirii documentului în propoziții. Câmpul cited_text nu se numără la tokenii de ieșire. Pentru documentele de peste 20.000 de tokeni, ghidul Anthropic despre halucinații recomandă ca Claude să extragă întâi citate cuvânt cu cuvânt și abia apoi să răspundă.

Contractele-tip ale firmei tale pot sta într-o bază de cunoștințe pentru Claude. Așa modelul are o referință pentru ce e obișnuit și ce iese din tipar.

Facturile ies în JSON pe schema ta, contractele cu pagina sursă, în două apeluri separate. Facturi: structured outputs / Contracte: Citations. Ce primești: JSON pe schema definită de tine / Răspuns cu pagina din care provine; Cum activezi: Parametrul

Exemplu lucrat: o lună de facturi pentru Zoho Books și un contract revizuit

Exemplul urmărește o firmă de distribuție care primește 200 de facturi de achiziție pe lună, în medie de câte două pagini. Scopul: datele ajung pregătite pentru Zoho Books, iar un om vede doar facturile care nu trec verificările.

Facturile, prin Message Batches API

  1. Programul verifică fiecare PDF: fără parolă, cu text extractibil. Scanările intră pe o listă separată.
  2. Fiecare factură devine o cerere în batch, cu un custom_id egal cu numărul intern de înregistrare, de exemplu FA-2026-09-017.
  3. Toate cererile folosesc aceeași schemă, prin output_config.format.
  4. Majoritatea batch-urilor se termină în mai puțin de o oră. Rezultatele rămân disponibile 29 de zile.
  5. Codul verifică dacă liniile adunate dau totalul, dacă furnizorul există în Zoho Books și dacă numărul facturii apare de două ori.
  6. Facturile care trec merg la aprobare în lot. Celelalte ajung la un om, cu PDF-ul și câmpul care nu se leagă.

Contractul, cu citări activate

Contractul-cadru cu cel mai mare furnizor are 40 de pagini. La 1.500-3.000 de tokeni de text pe pagină, înseamnă 60.000-120.000 de tokeni, plus imaginile paginilor. Cererea activează citările și întreabă, pe rând: durata, termenul de preaviz, penalitățile și termenul de plată. Fiecare răspuns vine cu intervalul de pagini.

Contractul intră în cache cu cache_control, ca întrebările următoare să nu-l plătească la preț întreg. La final, termenul de plată din contract se compară cu scadența de pe facturi. Orice diferență devine excepție pentru un om.

Ce model Claude alegi pentru facturi și contracte

Anthropic recomandă Claude Opus 5.5 ca punct de pornire când nu știi ce model să folosești. Pentru extragerea pe o schemă fixă poate fi testat și un model mai ieftin, pe un eșantion de facturi deja înregistrate. Claude Fable 5.1 rămâne pentru raționament solicitant, când Opus 5.5 nu ajunge la calitatea dorită nici la efort mai mare.

Tabelul compară trei modele actuale, cu prețuri în dolari americani pe milion de tokeni:

ModelIntrare / ieșire standardIntrare / ieșire în batchFereastră de context
Claude Haiku 4.51 / 5 USD0,50 / 2,50 USD200.000 de tokeni
Claude Sonnet 52 / 10 USD1 / 5 USD1M tokeni
Claude Opus 5.54 / 20 USD2 / 10 USD1M tokeni

Fereastra de context contează la PDF-uri. Sub 1M tokeni, o cerere primește cel mult 100 de pagini, nu 600. Cu Claude Haiku 4.5, un contract foarte lung trebuie deci împărțit în mai multe cereri.

Retragerea lui Claude Haiku 4.5 este anunțată nu mai devreme de 15 octombrie 2026. Verifică lista de modele Anthropic înainte să construiești un flux pe el.

Cât costă o lună de facturi: calculul pe pagini, batch și caching

O lună de 200 de facturi de câte două pagini înseamnă 400 de pagini. La 1.500-3.000 de tokeni de text pe pagină, rezultă între 600.000 și 1.200.000 de tokeni de intrare. Cu Claude Sonnet 5 în batch, la 1 USD pe milion, partea de text costă între 0,60 și 1,20 USD. La asta se adaugă imaginile paginilor și răspunsurile.

Pentru PDF-uri nu există taxă separată: plătești prețul standard al API-ului. Fiecare pagină devine însă imagine, deci se adaugă și costul calculat pentru imagini.

Message Batches API taxează toată utilizarea la 50% din prețul standard. Se potrivește pentru facturi care pot aștepta. Un batch expiră dacă nu se termină în 24 de ore și are cel mult 100.000 de cereri sau 256 MB. Cererile expirate, anulate sau cu eroare nu se plătesc.

Prompt caching este memorarea temporară a unei părți din cerere, ca apelurile următoare să o refolosească mai ieftin. Se potrivește cu întrebările repetate pe același contract. Cache-ul durează implicit 5 minute și se reîmprospătează gratuit la fiecare folosire. Scrierea costă cu 25% mai mult decât intrarea de bază, iar citirea costă 10% din ea pe majoritatea modelelor.

Sub o lungime minimă, cererea merge fără cache și fără eroare: 512 tokeni la Opus 5.5, 1.024 la Sonnet 5, 4.096 la Haiku 4.5. Reducerile din batch și caching se cumulează. Pentru bugetul complet al firmei, vezi cât costă Claude pe an pentru zece angajați.

Unde verifică un om: totaluri, excepții și documente nesigure

Un om verifică totalurile și orice excepție înainte ca ceva să ajungă în contabilitate. Documentația Anthropic spune că și cele mai avansate modele, inclusiv Claude, pot genera uneori text incorect sau în contradicție cu documentul. Fenomenul se numește halucinație.

Ghidul Anthropic despre halucinații propune câteva tehnici care reduc riscul:

  • Îi dai lui Claude voie explicit să spună că nu știe un răspuns.
  • Îi ceri să folosească doar informațiile din document, nu cunoștințele generale.
  • Rulezi același prompt de mai multe ori și compari rezultatele.
  • Îi ceri să susțină fiecare afirmație cu un citat și să o retragă dacă nu găsește unul.

Factura de la furnizor este conținut nesigur. Poate conține prompt injection, adică text ascuns care încearcă să schimbe ce face modelul. De aceea pasul care citește PDF-ul nu trebuie să aibă și drept de scriere în Zoho Books.

La Svennis construim pasul de citire fără niciun drept de scriere în contabilitate. Postarea o face un pas separat, abia după ce un om a aprobat excepțiile din lot.

Unde ajung datele: procesare globală sau în SUA, stocare în SUA

Pe API-ul Anthropic, datele se procesează global sau în SUA și se stochează în SUA. Două setări separate decid asta. Inference geo stabilește unde rulează modelul. Workspace geo stabilește unde stau datele și unde se face procesarea la endpoint, de exemplu transcodarea imaginilor.

Valoarea implicită pentru inference_geo este "global": modelul poate rula în orice geografie disponibilă. Poți cere "us", la 1,1 ori prețul standard. Pe Claude Haiku 4.5 parametrul nu funcționează, iar cererea întoarce eroare 400. Pentru workspace geo, singura valoare disponibilă acum este "us". O alegi la crearea workspace-ului și nu o mai poți schimba.

Zero data retention (ZDR) este un aranjament prin care Anthropic nu păstrează prompturile și răspunsurile după ce API-ul a răspuns. ZDR se activează pe organizație, prin echipa de cont Anthropic. Nu acoperă Claude Console, planurile de consum și interfețele Claude Teams și Enterprise.

Rezultatele din batch se păstrează 29 de zile, deci verifică ce acoperă aranjamentul tău. Chiar și cu ZDR, Anthropic poate păstra date când legea o cere sau când sistemele de siguranță le semnalează. Conversațiile semnalate pot fi păstrate până la 2 ani. Nu pune date personale în schema JSON, pentru că schema stă în cache până la 24 de ore.

Pe Amazon Bedrock și Google Cloud, procesatorul datelor este furnizorul de cloud, nu Anthropic. Fiecare dintre aceste platforme își stabilește propriile prețuri regionale.

Ce înseamnă procesarea cu Claude pentru o firmă din România

Pentru o firmă din România, prima decizie privește datele furnizorilor și clienților. Pe API-ul Anthropic, singura opțiune de stocare disponibilă acum este în SUA. Discută asta cu contabilul și cu persoana care răspunde de protecția datelor, înainte de pilot.

Între firme stabilite în România, factura valabilă este cea transmisă prin RO e-Factura, în format XML, pe care o descarci din SPV. Un PDF sau o scanare de la un furnizor român este doar o copie de vizualizare și nu se înregistrează în locul facturii din sistem. Pentru facturile de la furnizori români, datele se pot prelua direct din fișierul XML din RO e-Factura, fără extragere din PDF.

Limba documentelor nu este un obstacol. Toate modelele actuale Claude au capabilități multilingve și vision, potrivit documentației Anthropic. Fluxul cu Claude se potrivește pentru facturile de la furnizori din străinătate și pentru contracte. Claude le citește la fel de bine în română ca în alte limbi.

Unii furnizori din străinătate trimit facturi scanate. Pe API, Claude vede fiecare pagină ca imagine, deci poate citi și o scanare. O scanare fără text extractibil nu poate fi însă citată. Pentru astfel de documente merită o verificare umană mai atentă.

Datele din contracte pot ajunge și în Zoho CRM, pe fișa clientului sau a furnizorului. Durata, termenul de plată și data de reînnoire ajută echipa de vânzări și pe cea de achiziții. Scrierea lor rămâne un pas separat, după ce un om a citit răspunsul cu citări.

Pașii următori: un pilot pe o lună de facturi deja înregistrate

Cel mai sigur început pentru facturi procesate cu Claude este un pilot pe o lună închisă. Pașii de mai jos pot fi urmați în ordine:

  1. Înainte să trimiți facturi reale, decide unde rulezi: API-ul Anthropic, cu stocare în SUA, sau un furnizor de cloud. Verifică, împreună cu persoana care răspunde de protecția datelor, contractul de prelucrare cu furnizorul și temeiul pentru transferul datelor în afara UE.
  2. Alege o lună de facturi deja înregistrate în Zoho Books. Rezultatul corect îl ai deja, deci poți măsura.
  3. Scrie schema doar cu câmpurile de care are nevoie contabilul tău.
  4. Rulează extragerea în batch și compară fiecare câmp cu ce e înregistrat.
  5. Notează tipurile de excepții: scanări, totaluri, furnizori noi.
  6. Ia un contract, pune cele patru întrebări cu citări activate și verifică fiecare pagină citată.

După pilot, pasul firesc este legătura cu CRM-ul. Ghidul pas cu pas de conectare a lui Claude la Zoho CRM pornește de la citire și abia apoi trece la scriere, la fel ca fluxul de facturi descris aici.

Surse

  1. 1. PDF support - Claude Platform Docs
  2. 2. Structured outputs - Claude Platform Docs
  3. 3. Citations - Claude Platform Docs
  4. 4. Batch processing - Claude Platform Docs
  5. 5. Prompt caching - Claude Platform Docs
  6. 6. Upload files to Claude - Claude Help Center
  7. 7. Reduce hallucinations - Claude Platform Docs
  8. 8. Data residency - Claude Platform Docs
  9. 9. API and data retention - Claude Platform Docs
  10. 10. Models overview - Claude Platform Docs

Articole similare