A dokumentum akkor ér valamit, ha a benne lévő adat rendszerbe emelhető: a nettó összeg egy összegmező, a fizetési határidő egy dátum, a partner egy azonosított cég. A DocAI ezt a lépést végzi el magyar számlákon, szerződéseken, bérjegyzékeken és bankkivonatokon, megbízhatósági jelzéssel és a forrásoldalra mutató hivatkozással. A feldolgozás a cég saját szerverén fut.
Sok megoldás „AI dokumentumfeldolgozásnak" nevezi azt is, ami valójában csak keresés vagy chat a dokumentumok fölött. A különbség a kimenetben van.
| Szempont | OCR | Chat / RAG | KIE — adatkinyerés |
|---|---|---|---|
| Mit ad ki | Karaktereket: a kép szövegét | Szöveges választ egy kérdésre | Kitöltött mezőket: összeg, dátum, partner, tételsor |
| Determinisztikus? | Igen, de nem érti a tartalmat | Nem — kérdésfüggő, nem garantáltan teljes | Igen: ugyanaz a dokumentum ugyanazokat a mezőket adja |
| Beköthető a könyvelésbe? | Nem, előbb valakinek értelmeznie kell | Közvetlenül nem, mezőről mezőre nem vezethető át | Igen, ez a célja |
| Mire jó | Kereshetőség, teljes szöveges keresés | Kérdezés, összefoglalás, tájékozódás | Adatrögzítés kiváltása, automatizált ellenőrzés |
A DocAI mind a hármat tudja, az OCR és a dokumentum-chat is része a rendszernek, de a gerincét a strukturált adatkinyerés adja.
A rendszer először felismeri az irattípust, majd a hozzá tartozó kinyerési útra állítja a dokumentumot.
Minden kinyert mező mellett látszik a megbízhatósági szint (confidence), színkóddal. Ez nem díszítés: megmondja, hol érdemes ránézni az eredetire. A mezőből egy kattintással át lehet ugrani a forrás-PDF megfelelő oldalára, ahol az adat szerepel, így az ellenőrzés másodpercek kérdése, nem újraolvasásé.
Ha a rendszer bizonytalan, inkább üresen hagyja a mezőt, mint hogy kitaláljon egy értéket. Ez tudatos tervezési döntés: egy üres mező látható hiány, egy kitalált érték viszont észrevétlenül épül be a könyvelésbe. Az AI javaslatot tesz, a jóváhagyás emberi döntés marad.
A modellválasztásainkat nem gyártói adatlapok, hanem saját mérések döntik el magyar dokumentumokon, a saját hardverünkön.
A produkciós modell mezőszintű F1-mutatója a magyar KIE-korpuszon. Az összehasonlító mérés részletei: Gemma4 vs. Qwen3.6 →
A módszertan, a konfigurációk és a nyers eredmények elérhetők a docai-evals repóban, a negatív eredményekkel együtt.
Egy hibadetektorunk egyszer magabiztosan az ellenkezőjét állította a valóságnak. Megírtuk, hogyan derült ki: Amikor az eval hazudik →
Az OCR a kép szövegét ismeri fel, a kimenete karakterek sorozata. A kulcsinformáció-kinyerés (KIE, Key Information Extraction) ennél egy lépéssel tovább megy: megmondja, hogy a felismert szövegben melyik szám a nettó összeg, melyik dátum a fizetési határidő, és melyik cégnév a partner. A kimenet strukturált, mezőre pontos adat, amit közvetlenül be lehet emelni a könyvelésbe, nem egy szövegválasz, amit valakinek újra értelmeznie kell.
A rendszer dokumentumtípustól függő kinyerési utakat futtat: bejövő és kimenő számla, szerződés, bérjegyzék, bankszámlakivonat és teljesítésigazolás. Az irattípust automatikusan felismeri, és ennek megfelelő feldolgozási útra állítja a dokumentumot. A bérjegyzék dedikált, bizalmas szintű úton kerül feldolgozásra, elkülönítve az általános dokumentumfolyamtól.
A pontosságot saját, magyar üzleti dokumentumokból álló annotált korpuszon mérjük, mezőszintű F1-mutatóval. A jelenlegi produkciós modell a magyar KIE-korpuszon 0,975 F1-et ért el. A mérési módszertan és a nyers eredmények nyilvánosak a github.com/k3net/docai-evals repóban, beleértve azokat a méréseket is, amelyek nem a várt eredményt hozták.
A kinyert mezők megbízhatósági szintje (confidence) színkóddal jelenik meg, és a mező mellől át lehet ugrani a forrás-PDF megfelelő oldalára, ahol az adat szerepel. Bizonytalan adatot a rendszer inkább üresen hagy, mint hogy kitaláljon: az AI javaslatot tesz, a végső jóváhagyás emberi döntés marad.
On-premise üzemmódban nem. Az OCR, az adatkinyerés, a keresési index és a nyelvi modell is a szervezet saját GPU-szerverén fut, a dokumentumadat nem kerül külső felhőszolgáltatóhoz. A fájlok titkosítva tárolódnak, a hozzáférés szerepkör-alapú, és minden megnyitás, módosítás és letöltés naplózott.
Egy 30 perces bemutatón a saját folyamatán megyünk végig, a saját irataival. Kötelezettség nélkül.
Kérjen bemutatótUgyanaz a feldolgozó motor szolgálja ki mindegyik területet — aki egyet bevezet, az egészet megkapja.
Bejövő számlák kiolvasva, négy közhiteles forrásból ellenőrizve, NAV-adattal párosítva.
Részletek →Központi szerződés-portfólió, 30/60/90 napos lejáratfigyelés, várt vs. tényleges számlázás.
Részletek →Kérdezzen természetes nyelven a saját irattárától, forrásmegjelölt válasszal.
Részletek →Töltse ki az alábbi űrlapot, és munkatársunk hamarosan felveszi Önnel a kapcsolatot a rendszer bemutatásának egyeztetése érdekében.
Az adatokat kizárólag a megkeresés megválaszolásához használjuk fel. Külső félnek nem adjuk át. Jogalap: az Ön hozzájárulása, illetve a szerződéskötést megelőző lépések megtétele (GDPR 6. cikk (1) a) és b)). Részletek az adatkezelési tájékoztatóban.