Document Processing
Document Processing is de intelligente documentverwerkingsmodule (IDP) van Nashua 360. De module neemt de ongestructureerde papieren en digitale documenten die dagelijks een onderneming binnenkomen, zoals facturen, inkooporders, pakbonnen, aanvraagformulieren, contracten, afschriften en correspondentie, en zet deze om in schone, gevalideerde en gestructureerde data waarmee de rest van de suite kan werken zonder overtypen. De module lost het probleem van de documentachterstand op: het handmatig lezen, sorteren, overnemen en archiveren dat plaatsvindt tussen het moment dat een document binnenkomt en het moment dat een bedrijfsproces het kan gebruiken.
De module combineert nauwkeurige optische tekenherkenning, layoutbewuste AI-extractie, automatische classificatie, betrouwbaarheidsscores en beoordeling met een mens in de lus tot één beheerste pipeline. De module bevindt zich bij de voordeur van de suite en levert betrouwbare data aan finance, inkoop, contracten en operations, en werkt nauw samen met de AI Workers die documenten lezen, verifiëren en routeren naast mensen.
Wat de module doet
Document Processing neemt documenten in vanuit elk praktisch kanaal: een bewaakte mailbox, een scanner of multifunctioneel apparaat, een mobiele opname, een gecontroleerde map, een API-drop of een directe upload. De module verwerkt het volledige scala aan formaten, van schone digitale PDF's tot gefotografeerde, scheve, contrastarme en meerpagina-scans, en past rechtzetten, ruisonderdrukking, rotatie en pagina-splitsing toe voordat de herkenning begint. Optische tekenherkenning maakt van elke pagina doorzoekbare tekst met positiecoördinaten, en handschrift, stempels, barcodes, QR-codes en selectievakjes worden naast machineschrift gelezen.
Bovenop de herkenning komen classificatie en extractie. Elk document wordt geïdentificeerd op type en gerouteerd naar het bijpassende extractiemodel, dat de velden ophaalt die voor dat type van belang zijn: leveranciers- en afnemergegevens, document- en referentienummers, datums, regelitems, aantallen, stukprijzen, btw-regels en totalen, contractpartijen, voorwaarden en handtekeningen. Elke geëxtraheerde waarde draagt een betrouwbaarheidsscore en een verwijzing terug naar het exacte gebied van de pagina waar deze vandaan komt. Validatieregels, opzoekacties tegen stamgegevens en rekenkundige controles verlopen automatisch, zodat documenten die schoon aansluiten rechtstreeks doorstromen, terwijl documenten met een lage betrouwbaarheid of mislukte controles worden vastgehouden voor beoordeling. Het resultaat is een gestage stroom van schone, gestructureerde en aan de audit gekoppelde data die klaar is voor gebruik verderop in de keten.
Het domein en het datamodel
Centraal in de module staat het idee van een document zoals dit reist van een ruwe opgenomen afbeelding tot een betrouwbare registratie. Elk binnenkomend item wordt behandeld als een afzonderlijk object met een eigen herkomst, eigen pagina's en eigen historie, zodat dezelfde factuur die tweemaal wordt gefotografeerd, of een batch die als één bestand wordt gescand, uiteenvalt in de individuele documenten waar een bedrijf daadwerkelijk om geeft.
Elk document wordt begrepen aan de hand van drie samenhangende begrippen. Ten eerste het type, dat aangeeft wat voor soort ding het is en dus wat ervan wordt verwacht: een factuur veronderstelt een leverancier, totalen en btw; een contract veronderstelt partijen en voorwaarden. Het type stuurt alles wat volgt. Ten tweede de geëxtraheerde inhoud, vastgelegd als een set benoemde velden en, waar relevant, herhalende regels, waarbij elke waarde is gebonden aan de positie op de pagina waar deze is gevonden en aan de betrouwbaarheid die het systeem eraan toekent. Deze binding maakt elk getal herleidbaar naar de bron in plaats van los te worden beweerd. Ten derde de status, het punt dat het document heeft bereikt op de reis van opgenomen, via geclassificeerd en geëxtraheerd, tot beoordeeld en vrijgegeven, samen met wie of wat bij elke stap heeft gehandeld.
Daaromheen liggen de referentiepunten die extractie betekenis geven: de leveranciers, klanten, rekeningen en catalogusvermeldingen waartegen een waarde wordt gematcht, en de extractieprofielen die beschrijven hoe een bepaald type uit een bepaalde bron moet worden gelezen. De relaties zijn eenvoudig en zakelijk leesbaar: een document is van een type, bevat velden en regels, wordt gematcht aan bekende partijen en laat een ononderbroken spoor achter van de handen en beslissingen die het hebben gevormd.
De belangrijkste workflows
De dagelijkse workflow is straight-through processing. Een document komt binnen, wordt geclassificeerd, geëxtraheerd, gevalideerd en, als aan elke controle is voldaan, vrijgegeven aan het ontvangende proces zonder menselijke tussenkomst. De maatstaf voor de module is welk aandeel van het volume dit pad veilig doorloopt, en de controles bestaan om dat aandeel hoog te houden zonder dat een verkeerd document doorglipt.
De tweede workflow is de uitzonderingsbeoordeling. Wanneer de betrouwbaarheid van een veld onder de drempelwaarde zakt, een validatieregel faalt, of een totaal niet aansluit, wordt het document in de wachtrij gezet voor een beoordelaar. Het beoordelingsscherm plaatst de geëxtraheerde waarden naast de originele afbeelding, markeert het exacte gebied waar elke waarde vandaan komt, signaleert de specifieke velden waarover twijfel bestaat en laat een medewerker met een paar toetsaanslagen bevestigen of corrigeren. Correcties worden vastgelegd als feedback en verscherpen de extractie voor vergelijkbare documenten daarna. Een derde workflow behandelt classificatie-onzekerheid, waarbij een document dat niet duidelijk overeenkomt met een bekend type wordt getrieerd, gelabeld en, als het een terugkerend nieuw formulier betreft, aan het systeem wordt aangeleerd. Batchopname, het splitsen van gecombineerde bestanden, het herverwerken van gewijzigde documenten en bulkgoedkeuring maken het operationele beeld compleet, en elk pad wordt beheerd door rolgebaseerde wachtrijen, servicelevel-timers en volledige statuszichtbaarheid, zodat niets ongezien blijft steken.
Functionele diepgang die telt
De kwaliteit van de extractie rust op layoutbewuste modellen die een pagina lezen als een gestructureerd object, met begrip van tabellen, kolommen, sleutel-waardeparen en meerpagina-vervolgen, in plaats van als een platte stroom tekens. Dit is wat het mogelijk maakt om regelitems als samenhangende rijen vast te leggen en totalen aan hun componenten te koppelen. De betrouwbaarheid wordt per veld gekalibreerd, zodat drempelwaarden strak kunnen worden gezet op de waarden die financieel of juridisch gewicht dragen en ruim op de waarden die dat niet doen, waardoor de module het werk nauwkeurig kan routeren in plaats van alles of niets te beoordelen.
Validatie is waar de correctheid wordt afgedwongen. De module voert rekenkundige aansluiting uit op documenten met regelitems en totalen, en controleert of aantallen, stukprijzen, subtotalen, kortingen, btw en eindtotaal met elkaar overeenkomen. De module valideert de btw-behandeling tegen verwachte tarieven en registratienummers, verifieert partijgegevens tegen stamgegevens, detecteert duplicaten op basis van inhoud in plaats van bestandsnaam, en past formaat- en bereikregels toe op datums, valuta's en referenties. Geëxtraheerde data wordt genormaliseerd naar consistente eenheden, datumnotaties, valutacodes en partij-identifiers, zodat systemen verderop in de keten uniforme waarden ontvangen, ongeacht hoe de bron ze heeft uitgedrukt. Elk document behoudt een onveranderbare registratie van de originele afbeelding, elke geëxtraheerde waarde, elke geautomatiseerde controle en elke menselijke beslissing, waarbij de data wordt beheerd onder strikte toegangscontroles en bewaarbeleid. Die combinatie van aansluiting, normalisatie, duplicaatdetectie en een ononderbroken audittrail is wat het bedrijf in staat stelt de data voldoende te vertrouwen om erop te boeken, te betalen of te contracteren.
Hoe het past in de Nashua 360-suite
Document Processing is de opnamelaag voor een groot deel van de suite, en de waarde ervan komt voort uit wat het aanlevert. Geëxtraheerde leveranciersfacturen stromen rechtstreeks naar Accounts Payable en het bredere Finance-grootboek, en komen binnen als gematchte, gecodeerde en aangesloten boekingen die klaar zijn voor three-way matching tegen de orders en ontvangsten in Procurement. Opgenomen contracten en de geëxtraheerde partijen, datums en voorwaarden vullen Contract Management, zodat verplichtingen en verlengingsdatums worden bijgehouden vanaf het moment dat een ondertekend document binnenkomt. Klantformulieren en correspondentie worden gekoppeld aan de relevante registraties in het CRM, en vrijgegeven documenten worden gearchiveerd in Document Management als systeem van registratie, met hun metadata reeds ingevuld.
Omdat de extractie partijen en catalogusitems oplost tegen gedeelde stamgegevens, landt de gestructureerde output tegen dezelfde leveranciers, klanten, rekeningen en producten die de rest van Nashua 360 al gebruikt, zonder aansluitkloof. Goedkeuringen en uitzonderingen die hier ontstaan, komen naar voren via het gemeenschappelijke workflow- en notificatieweefsel dat door de hele suite loopt, en elk vrijgegeven document behoudt zijn verwijzing terug naar de bron, zodat elke registratie verderop in de keten kan worden herleid tot de pagina waar deze vandaan komt.
Hoe AI Workers erin opereren
AI Workers zijn volwaardige deelnemers binnen Document Processing, geen toevoeging achteraf. Zij verrichten het lezen en redeneren waarvan classificatie en extractie afhankelijk zijn, en zij handelen op basis van de resultaten. Een worker kan in gewone taal worden gevraagd om de module rechtstreeks te bevragen, om te rapporteren hoeveel facturen van een bepaalde leverancier op beoordeling wachten, welke documenten deze week niet aansloten, of waar een bepaalde referentie voorkomt, en beantwoordt dit vanuit live moduledata met verwijzingen naar de onderliggende pagina's.
Workers voeren ook acties uit, niet alleen antwoorden. Zij classificeren binnenkomende documenten, extraheren en normaliseren velden, matchen partijen tegen stamgegevens, en geven schone documenten vrij aan hun bestemmingsprocessen zonder menselijke tussenkomst waar betrouwbaarheid en controles dit toelaten. Zij letten voortdurend op afwijkingen en uitzonderingen, signaleren dubbele inzendingen, totalen die niet aansluiten, onverwachte btw-behandelingen, waarden buiten het patroon en documenten die niet overeenkomen met een bekend type, en leggen deze voor aan de juiste persoon met het bewijs erbij. Waar een waarde dubbelzinnig is, biedt een worker beslissingsondersteuning door de meest waarschijnlijke lezing voor te stellen, met de redenering en het bronregio, zodat een mens deze kan bevestigen. En een worker kan optreden als goedkeurings- of beoordelingsknooppunt in een workflow, waarbij het een document toetst aan beleid en dit vervolgens doorstuurt, vasthoudt of escaleert naar een aangewezen beoordelaar, zodat mensen hun aandacht alleen besteden aan de afwegingen die dat werkelijk nodig hebben.
