Il motore di riconoscimento (OCR e IA)

L'intelligenza che legge i vostri documenti si basa su due componenti, eseguiti interamente sul vostro server:

  • Il modulo OCR — individua e ritaglia il testo presente sul documento (importi, date, intestazioni, tabelle).
  • Il modulo IA — si basa sul modello linguistico Qwen, un modello open source, per comprendere questo testo ed estrarne le informazioni utili (fornitore, importo, data, tipo di documento). Nessun dato viene inviato a un servizio online: il modello gira esclusivamente presso di voi.

Il motore può funzionare su un normale processore (CPU) oppure, se il vostro server ne dispone, su una scheda grafica (GPU) — la GPU accelera notevolmente l'elaborazione ma non è indispensabile.

MinimoConsigliato
Memoria (RAM)16 GB32 GB
Spazio su disco500 GB SSD2 TB SSD
Scheda grafica (GPU)Nessuna (funziona su CPU)8 GB di memoria video (VRAM) o più

Per darvi un'idea, su una GPU con 8 GB di memoria video, l'analisi di un documento richiede circa 5 secondi. Su un processore da solo (senza GPU), può richiedere fino a 3 minuti — più lento, ma del tutto utilizzabile per l'uso quotidiano.

Il motore riconosce il testo in qualsiasi lingua che utilizza l'alfabeto latino (francese, italiano, tedesco, inglese, ecc.) e rileva automaticamente la lingua del documento — non dovete specificare nulla. Nella versione attuale riconosce tre tipi di documento: fattura, ricevuta e altro (per qualsiasi documento che non rientri nei primi due tipi).

Potete in qualsiasi momento monitorare lo stato del motore — coda, modalità di esecuzione (CPU o GPU), disponibilità — dalla dashboard dello stato del motore (riservata agli amministratori). Ogni documento segue lì il proprio percorso tecnico, diverso dal suo percorso di convalida (vedi la pagina Sicurezza e conformità):

  • In attesa — il documento è in coda, non ancora preso in carico dal motore.
  • In elaborazione — il motore lo sta leggendo e analizzando.
  • Completato — l'analisi è terminata, il risultato è pronto per la verifica del vostro team.
  • Fallito — l'analisi non è andata a buon fine (ad esempio documento illeggibile); nexdoc riprova automaticamente prima di segnalarvi un fallimento persistente.