Un operator deschide un PDF, citește furnizorul, numărul, data și totalul, apoi le tastează în programul de contabilitate. Repetă asta de sute de ori pe lună, iar la un moment dat apare o cifră inversată. Un sistem de procesare a documentelor cu AI preia cititul și tastatul și îi lasă omului ce face mai bine: să verifice cazurile neclare și să decidă.
Merită spus de la început ce nu are rost să treacă prin AI. Facturile primite de la furnizori români prin sistemul e-Factura sosesc deja în format structurat, deci se importă direct, fără nicio citire. Extragerea cu AI ajută la rest: facturi din străinătate, bonuri, contracte, avize, formulare completate de mână, arhiva scanată.
Ce fel de documente se pretează și care nu
Cel mai bine merg documentele cu structură repetitivă și text tipărit: facturi, avize, extrase, comenzi, polițe, formulare standard. Chiar dacă fiecare furnizor își așază factura altfel, câmpurile căutate sunt aceleași, iar modelele actuale le găsesc fără un șablon separat pentru fiecare emitent.
Contractele sunt alt caz. Se pot extrage elementele factuale: părțile, datele, durata, valoarea, termenele de plată. Interpretarea unei clauze rămâne treaba juristului; sistemul îi poate arăta doar unde se află în text.
Slab merg scrisul de mână grăbit, fotografiile făcute pieziș cu telefonul, copiile după copii și ștampilele puse peste cifre. Aici verificarea de către om va fi regula, nu excepția.
Drumul unui document, de la scanare la programul firmei
Să zicem că primești zilnic, pe email, facturi de la furnizori externi și avize scanate la depozit. Fluxul le preia de acolo, fără încărcare manuală.
Dintre pașii de mai jos, ecranul de verificare hotărăște dacă operatorii adoptă sistemul: documentul stă în stânga, câmpurile extrase în dreapta, iar la selectarea unui câmp se evidențiază locul din pagină de unde provine.
- Preluare: din email, dintr-un dosar partajat sau de la scaner; fișierele se clasifică pe tipuri de document.
- Citire: paginile strâmbe se îndreaptă, apoi OCR (recunoașterea optică a caracterelor) transformă imaginea în text.
- Extragere: un model lingvistic întoarce câmpurile cerute într-o structură fixă, inclusiv liniile de tabel.
- Control: reguli care verifică rezultatul, independent de model.
- Verificare de către om: doar la documentele care nu trec controlul sau au câmpuri lipsă.
- Export: datele confirmate ajung în programul de contabilitate sau în ERP, prin API (interfața lui de schimb de date) sau prin fișier de import.
De ce nu ne bazăm pe „siguranța” modelului
Un model lingvistic nu oferă o măsură de încredere pe care să te poți bizui: poate întoarce o cifră greșită la fel de sigur ca pe una corectă. De aceea, decizia „trece automat sau merge la om” o iau regulile, nu modelul.
Regulile folosesc ce se poate calcula. Suma liniilor trebuie să dea totalul. TVA-ul trebuie să corespundă bazei. Codul fiscal românesc și contul IBAN au cifre de control care se verifică matematic. Aceeași pereche furnizor plus număr de factură nu are voie să intre de două ori.
Pentru câmpurile importante putem face și o a doua citire, independentă, cu alt instrument, și trimitem la om orice nepotrivire. Costă mai mult pe document, deci o aplicăm doar unde miza o cere.
Unde sunt prelucrate documentele sensibile
Contractele, actele de identitate, documentele medicale sau statele de plată conțin date personale și secrete comerciale. Înainte de a alege tehnologia, stabilim cu responsabilul tău cu protecția datelor ce documente intră în flux și în ce condiții.
Variantele sunt trei. Prima: servicii în cloud cu prelucrare într-o regiune din Uniunea Europeană și cu acord de prelucrare a datelor, la care verificăm dacă documentele sunt folosite pentru antrenare. A doua: modele rulate pe infrastructura ta, cu un OCR cu sursă deschisă precum Tesseract și un model lingvistic local; datele nu pleacă nicăieri, dar acuratețea și costul echipamentelor trebuie cântărite. A treia: o combinație, în care doar documentele obișnuite merg în cloud.
Indiferent de variantă, păstrăm documentul original, datele extrase și numele celui care le-a confirmat, cu drepturi de acces pe roluri.
Cum măsurăm un flux de procesare documente cu AI înainte de pornire
Nu promitem o acuratețe înainte de a vedea documentele tale. Cerem un eșantion reprezentativ, cu tot cu exemplarele urâte, îl trecem prin flux și comparăm rezultatul, câmp cu câmp, cu datele introduse corect de oamenii tăi.
După pornire, corecturile operatorilor se analizează periodic: arată ce reguli trebuie adăugate și ce emitenți trimit constant documente greu de citit. Înainte de pornire, proba răspunde la câteva întrebări:
- Câte documente trec fără nicio intervenție.
- Pe ce câmpuri apar cele mai multe corecturi și de ce.
- Cât durează verificarea unui document față de introducerea lui de la zero.
- Ce tipuri de documente ar trebui lăsate, deocamdată, în afara fluxului.
Întrebări frecvente
Mai e nevoie de oameni dacă documentele sunt citite de AI?
Da, pentru cazurile neclare și pentru controlul prin sondaj al celor trecute automat. Munca se mută de la tastat la verificat.
Funcționează cu documente în alte limbi?
Modelele actuale citesc bine principalele limbi europene, inclusiv româna cu diacritice. Pentru alfabete sau formate mai rare, verificăm pe eșantionul tău.
Cum se formează costul pe document?
Din volumul lunar de pagini, varietatea tipurilor de documente, locul prelucrării (cloud sau local) și complexitatea exportului. Serviciile de citire din cloud se plătesc de regulă la pagină sau la utilizare.
Aceasta este o descriere de proiect-tip: arată cum abordăm de obicei o astfel de lucrare și nu prezintă un proiect făcut pentru un client anume. Fiecare proiect real pornește de la situația firmei tale, iar etapele, termenele și prețul se stabilesc după discuția de început.