Document Processing
Document Processing è il modulo di elaborazione intelligente dei documenti (IDP) di Nashua 360, che prende i documenti cartacei e digitali non strutturati che entrano ogni giorno in un'azienda, fatture, ordini di acquisto, bolle di consegna, moduli, contratti e corrispondenza, e li trasforma in dati puliti, validati e strutturati su cui il resto della suite può agire senza reinserimento manuale. Combina OCR ad alta accuratezza, estrazione AI consapevole del layout, classificazione, punteggio di affidabilità e revisione human-in-the-loop in un'unica pipeline governata, collocandosi alla porta d'ingresso della suite e alimentando con dati affidabili finanza, approvvigionamento, contratti e operazioni.
Cosa fa il modulo
Document Processing acquisisce documenti da ogni canale pratico: una casella di posta monitorata, uno scanner o un dispositivo multifunzione, un'acquisizione da mobile, una cartella sorvegliata, un drop via API o un caricamento diretto. Gestisce l'intera gamma di formati, dai PDF digitali puliti alle scansioni fotografate, disallineate, a basso contrasto e multipagina, applicando raddrizzamento, riduzione del rumore, rotazione e suddivisione delle pagine prima del riconoscimento. Il riconoscimento ottico dei caratteri converte ogni pagina in testo ricercabile con coordinate posizionali, e la scrittura manuale, i timbri, i codici a barre, i codici QR e le caselle di spunta vengono letti insieme alla stampa a macchina.
Sopra il riconoscimento si collocano la classificazione e l'estrazione. Ogni documento viene identificato per tipo e instradato al modello di estrazione corrispondente, che estrae i campi rilevanti per quel tipo: identità di fornitore e acquirente, numeri di documento e di riferimento, date, righe di dettaglio, quantità, prezzi unitari, righe di imposta e totali, parti contrattuali, termini e firme. Ogni valore estratto porta con sé un punteggio di affidabilità e un collegamento alla regione esatta della pagina da cui proviene. Le regole di validazione, i confronti con i dati anagrafici e i controlli aritmetici vengono eseguiti automaticamente, così che i documenti che si riconciliano correttamente passino direttamente, mentre quelli con bassa affidabilità o controlli non superati vengano trattenuti per la revisione. Il risultato è un flusso costante di dati puliti, strutturati e collegati alla tracciabilità, pronti per l'uso a valle.
Il dominio e il modello dei dati
Al centro del modulo c'è l'idea di un documento nel suo percorso da immagine acquisita grezza a record affidabile. Ogni elemento in arrivo è trattato come un oggetto distinto con la propria origine, le proprie pagine e la propria storia, così che la stessa fattura fotografata due volte, o un lotto scansionato come un unico file, si risolva nei singoli documenti a cui l'azienda tiene realmente.
Ogni documento viene compreso attraverso tre nozioni correlate. Primo, il suo tipo, che indica di quale genere di cosa si tratta e quindi cosa ci si aspetta da esso: una fattura si aspetta un fornitore, dei totali e l'imposta; un contratto si aspetta parti e termini. Il tipo guida tutto ciò che segue. Secondo, il suo contenuto estratto, conservato come un insieme di campi denominati e, ove pertinente, righe ripetute, ciascun valore vincolato alla posizione sulla pagina in cui è stato trovato e all'affidabilità che il sistema attribuisce ad esso. È questo vincolo a rendere ogni dato tracciabile fino alla fonte anziché affermato in isolamento. Terzo, il suo stato, il punto raggiunto nel percorso da acquisito, attraverso classificato ed estratto, fino a rivisto e rilasciato, insieme a chi o cosa ha agito in ciascun passaggio.
Attorno a questi si collocano i punti di riferimento che danno significato all'estrazione: i fornitori, i clienti, i conti e le voci di catalogo con cui un valore viene confrontato, e i profili di estrazione che descrivono come un dato tipo proveniente da una data fonte debba essere letto. Le relazioni sono semplici e comprensibili in chiave aziendale: un documento è di un tipo, contiene campi e righe, viene abbinato a parti note e lascia una traccia ininterrotta delle mani e delle decisioni che lo hanno plasmato.
I flussi di lavoro principali
Il flusso di lavoro quotidiano è l'elaborazione diretta senza interventi. Un documento arriva, viene classificato, estratto, validato e, se ogni controllo è soddisfatto, rilasciato al processo ricevente senza alcun intervento umano. La misura del modulo è quanto ampia sia la quota di volume che percorre questo tragitto in sicurezza, e i controlli esistono per mantenere alta tale quota senza lasciar passare un documento errato.
Il secondo flusso di lavoro è la revisione delle eccezioni. Quando l'affidabilità su un campo scende sotto la sua soglia, una regola di validazione fallisce o un totale non si riconcilia, il documento viene messo in coda per un revisore. La superficie di revisione colloca i valori estratti accanto all'immagine originale, evidenzia la regione esatta da cui proviene ciascun valore, segnala i campi specifici in dubbio e permette a una persona di confermare o correggere con pochi tasti. Le correzioni vengono acquisite come feedback, affinando l'estrazione per documenti simili in seguito. Un terzo flusso di lavoro gestisce l'incertezza di classificazione, in cui un documento che non corrisponde chiaramente a un tipo noto viene selezionato, etichettato e, se rappresenta un nuovo modulo ricorrente, insegnato al sistema. L'acquisizione in lotti, la suddivisione di file combinati, la rielaborazione di documenti modificati e l'approvazione massiva completano il quadro operativo, e ogni tragitto è governato da code basate sui ruoli, timer di livello di servizio e piena visibilità dello stato, così che nulla si blocchi senza essere visto.
Profondità funzionale che conta
La qualità dell'estrazione poggia su modelli consapevoli del layout che leggono una pagina come un oggetto strutturato, comprendendo tabelle, colonne, coppie chiave-valore e continuazioni multipagina, anziché come un flusso piatto di caratteri. È questo che consente di acquisire le righe di dettaglio come righe coerenti e di legare i totali ai loro componenti. L'affidabilità è calibrata per campo, così che le soglie possano essere impostate in modo rigoroso sui valori che hanno peso finanziario o legale e in modo permissivo su quelli che non ne hanno, permettendo al modulo di instradare il lavoro con precisione anziché rivedere tutto o niente.
La validazione è il punto in cui viene imposta la correttezza. Il modulo esegue la riconciliazione aritmetica sui documenti che riportano righe di dettaglio e totali, verificando che quantità, prezzi unitari, subtotali, sconti, imposta e totale generale concordino. Convalida il trattamento fiscale rispetto alle aliquote attese e agli identificativi di registrazione, verifica i dettagli delle parti rispetto ai record anagrafici, rileva i duplicati in base al contenuto anziché al nome del file, e applica regole di formato e di intervallo a date, valute e riferimenti. I dati estratti vengono normalizzati in unità, formati di data, codici valuta e identificativi di parte coerenti, così che i sistemi a valle ricevano valori uniformi indipendentemente da come la fonte li abbia espressi. Ogni documento conserva un record immutabile della propria immagine originale, di ciascun valore estratto, di ciascun controllo automatizzato e di ciascuna decisione umana, con i dati gestiti sotto rigorosi controlli di accesso e politiche di conservazione. Questa combinazione di riconciliazione, normalizzazione, rilevamento dei duplicati e traccia di audit ininterrotta è ciò che consente all'azienda di fidarsi dei dati abbastanza da registrarli, pagarli o stipulare contratti su di essi.
Come si integra nella suite Nashua 360
Document Processing è il livello di acquisizione per gran parte della suite, e il suo valore deriva da ciò che alimenta. Le fatture fornitore estratte confluiscono direttamente nell'Accounts Payable e nella più ampia contabilità Finance, arrivando come registrazioni abbinate, codificate e riconciliate, pronte per l'abbinamento a tre vie rispetto agli ordini e alle ricevute conservati nel Procurement. I contratti acquisiti e le relative parti, date e termini estratti popolano il Contract Management, così che obblighi e date di rinnovo siano tracciati dal momento in cui un documento firmato arriva. I moduli e la corrispondenza dei clienti vengono allegati ai record pertinenti nel CRM, e i documenti rilasciati vengono archiviati nel Document Management come sistema di riferimento con i loro metadati già popolati.
Poiché l'estrazione risolve le parti e le voci di catalogo rispetto ai dati anagrafici condivisi, l'output strutturato si aggancia agli stessi fornitori, clienti, conti e prodotti che il resto di Nashua 360 già utilizza, senza alcuno scarto di riconciliazione. Le approvazioni e le eccezioni sollevate qui emergono attraverso il tessuto comune di workflow e notifiche che attraversa la suite, e ogni documento rilasciato mantiene il proprio collegamento alla fonte, così che qualsiasi record a valle possa essere ricondotto alla pagina da cui proviene.
Come operano gli AI Workers al suo interno
Gli AI Workers sono partecipanti a pieno titolo in Document Processing, non un componente aggiuntivo. Svolgono la lettura e il ragionamento da cui dipendono la classificazione e l'estrazione, e agiscono sui risultati. A un worker può essere chiesto in linguaggio naturale di interrogare direttamente il modulo, di riferire quante fatture di un dato fornitore sono in attesa di revisione, quali documenti non hanno superato la riconciliazione questa settimana o dove compare un particolare riferimento, ed esso risponde a partire dai dati in tempo reale del modulo con collegamenti alle pagine sottostanti.
I worker eseguono azioni oltre a rispondere. Classificano i documenti in arrivo, estraggono e normalizzano i campi, risolvono le parti rispetto ai dati anagrafici e rilasciano i documenti puliti ai processi di destinazione senza intervento umano dove l'affidabilità e i controlli lo consentono. Sorvegliano continuamente alla ricerca di anomalie ed eccezioni, segnalando invii duplicati, totali che non si riconciliano, trattamenti fiscali inattesi, valori fuori schema e documenti che non corrispondono a un tipo noto, e li portano all'attenzione della persona giusta con le prove allegate. Dove un valore è ambiguo, un worker offre supporto decisionale, proponendo la lettura più probabile con il proprio ragionamento e la regione di origine perché una persona la confermi. E un worker può fungere da nodo di approvazione o revisione in un flusso di lavoro, verificando un documento rispetto alle policy e o facendolo procedere, o trattenendolo, o inoltrandolo a un revisore designato, così che le persone dedichino la loro attenzione soltanto ai giudizi che ne hanno realmente bisogno.
