Das Erkennungsmodul (OCR und KI)

Die Intelligenz, die Ihre Dokumente liest, beruht auf zwei Komponenten, die vollständig auf Ihrem Server laufen:

  • Das OCR-Modul — erkennt und erfasst den Text auf dem Dokument (Beträge, Daten, Kopfzeilen, Tabellen).
  • Das KI-Modul — nutzt das Sprachmodell Qwen, ein Open-Source-Modell, um diesen Text zu verstehen und die nützlichen Informationen zu extrahieren (Lieferant, Betrag, Datum, Dokumenttyp). Es werden keine Daten an einen Online-Dienst gesendet: Das Modell läuft ausschliesslich bei Ihnen.

Das Modul kann auf einem gewöhnlichen Prozessor (CPU) oder, falls Ihr Server über eine verfügt, auf einer Grafikkarte (GPU) laufen — die GPU beschleunigt die Verarbeitung deutlich, ist aber nicht zwingend erforderlich.

MinimumEmpfohlen
Arbeitsspeicher (RAM)16 GB32 GB
Speicherplatz500 GB SSD2 TB SSD
Grafikkarte (GPU)Keine (läuft auf CPU)8 GB Grafikspeicher (VRAM) oder mehr

Zur Orientierung: Auf einer GPU mit 8 GB Grafikspeicher dauert die Analyse eines Dokuments etwa 5 Sekunden. Auf einem reinen Prozessor (ohne GPU) kann es bis zu 3 Minuten dauern — langsamer, aber für den täglichen Gebrauch durchaus tauglich.

Das Modul erkennt Text in jeder Sprache mit lateinischem Alphabet (Französisch, Italienisch, Deutsch, Englisch usw.) und erkennt die Sprache des Dokuments automatisch — Sie müssen nichts angeben. In der aktuellen Version erkennt es drei Dokumenttypen: Rechnung, Quittung und Sonstiges (für alle Dokumente, die nicht in die ersten beiden Typen fallen).

Sie können den Status des Moduls jederzeit überwachen — Warteschlange, Ausführungsmodus (CPU oder GPU), Verfügbarkeit — über das Dashboard zum Modulstatus (nur für Administratoren). Jedes Dokument durchläuft dort seinen eigenen technischen Weg, der sich von seinem fachlichen Freigabeweg unterscheidet (siehe die Seite Sicherheit und Compliance):

  • Wartend — das Dokument befindet sich in der Warteschlange, wurde vom Modul noch nicht übernommen.
  • In Bearbeitung — das Modul liest und analysiert es gerade.
  • Abgeschlossen — die Analyse ist beendet, das Ergebnis ist bereit für die Prüfung durch Ihr Team.
  • Fehlgeschlagen — die Analyse war nicht erfolgreich (z. B. unlesbares Dokument); nexdoc versucht es automatisch erneut, bevor Ihnen ein dauerhafter Fehler gemeldet wird.