Estrazione dati senza template, dal 2012 all'AI generativa

L'estrazione dati senza template è il motivo per cui AIDA esiste: la nostra piattaforma di intelligent document processing (IDP) è nata nel 2012, dieci anni prima di ChatGPT, per leggere i dati dai documenti imparando dall'utente con un clic, invece di chiedere modelli costruiti a mano. Oggi l'AI generativa potenzia quel motore, che resta il fondamento di tutto il prodotto.
Chi sceglie oggi un software IDP si trova spesso davanti a due tipi di proposte. Da una parte le piattaforme storiche, nate sull'estrazione basata su template. Dall'altra le startup degli ultimi tre anni, che affidano tutto a un modello linguistico e mostrano demo convincenti sulla prima fattura. AIDA arriva da una strada diversa, e conoscerla aiuta a capire che cosa succede dopo la demo, quando entrano in gioco migliaia di documenti veri.
Che cos'era l'estrazione dati basata su template?
L'estrazione basata su template descrive in anticipo dove si trova ogni dato su un certo layout di documento: si disegnano zone o si scrivono regole che cercano parole chiave e posizioni relative, poi il software applica quella descrizione ai documenti in arrivo.
Nel 2012 il mercato del data capture era guidato da ABBYY e Kofax (oggi Tungsten Automation), con piattaforme potenti costruite su questo principio. In ABBYY FlexiCapture la struttura dei documenti a layout variabile si descrive con un programma dedicato, FlexiLayout Studio; in Kofax Transformation Modules i progetti di estrazione si preparano e si testano in Project Builder, per il quale esistono corsi di formazione specifici.
Chi ha seguito un progetto di acquisizione documentale in quegli anni ne ricorda bene i limiti:
- la configurazione richiedeva tecnici specializzati, software e formazione dedicati, prima ancora di elaborare il primo documento;
- ogni nuovo fornitore con un layout diverso significava un nuovo template o nuove regole da scrivere;
- con i documenti non strutturati, come le lettere o gli atti di uno studio legale, il template non aveva punti fissi a cui agganciarsi, perché il dato poteva trovarsi in qualsiasi frase del testo;
- addestramento e produzione erano processi separati: il progetto si preparava in un ambiente di progettazione, si pubblicava in produzione e ogni modifica ripercorreva lo stesso giro;
- un layout che cambiava anche di poco poteva compromettere l'estrazione, finché qualcuno non aggiornava il template.
Come funziona l'estrazione dati senza template di AIDA?
AIDA impara dall'utente mentre lavora: per insegnarle un campo basta selezionare la proprietà e fare clic sul valore nel documento. Un clic su un solo documento, e da quel momento AIDA sa che cosa cercare nei documenti successivi dello stesso tipo.
In AIDA il tipo di documento non dipende dall'aspetto grafico, ma solo dai dati che vuoi estrarre. Una fattura passiva resta una fattura passiva, che arrivi dal fornitore A o dal fornitore B con un layout completamente diverso.
Quando confermi il primo documento con un layout nuovo, AIDA impara a leggerlo; quando arriva un altro documento con un layout uguale o simile, lo riconosce da sola. Nessuno deve disegnare un template, dargli un nome o indicare quale usare per ciascun documento, nemmeno quando i fornitori sono centinaia.
Molte soluzioni riconoscono un elenco fisso di campi standard, come fornitore, numero, data e importi di una fattura. Le proprietà intelligenti di AIDA riconoscono da sempre date, partite IVA, IBAN e altri valori comuni senza addestramento, ma i dati che contano per un'azienda sono spesso altri: il numero di commessa, il centro di costo, la targa del mezzo, il codice POD di una bolletta. AIDA impara anche quelli, con un clic, su qualsiasi tipo di documento, e con AIDA Boost li trova già dal primo.
Le proprietà intelligenti e l'apprendimento con un clic non dipendono da un modello linguistico: poggiano su un'analisi minuziosa della struttura del documento, che sviluppiamo dal 2012. L'algoritmo di AIDA ricostruisce il modo in cui una persona riconosce un documento e ne individua le informazioni chiave. Questo approccio è unico sul mercato ed è la base solida che AIDA Boost potenzia, senza sostituirla.
La differenza più profonda rispetto ai sistemi di allora è che addestramento e produzione coincidono. L'operatore apre un documento in attesa, controlla i valori proposti, fa clic su quelli mancanti o da correggere e conferma. La conferma archivia il documento o lo invia alla destinazione scelta e, con lo stesso gesto, consolida quanto AIDA ha imparato. Non servono un ambiente di progettazione separato né un consulente che ripubblichi il progetto.
Nel 2012 era un approccio dirompente, e la ragione per cui funziona è rimasta la stessa: chi conosce davvero i documenti è chi li lavora ogni giorno, non chi configura il software. AIDA mette l'apprendimento nelle mani di quella persona, senza codice e senza formazione specialistica. Era human in the loop molto prima che l'AI generativa rendesse comune l'espressione.
Quando i risultati sono stabili, una regola di automazione può confermare i documenti da sola, mentre AIDA evidenzia in giallo i valori anomali da verificare. Trovi i dettagli nella pagina sull'estrazione automatica dei dati con AIDA.
Perché l'AI generativa da sola non basta nella gestione documentale?
Un modello linguistico legge bene anche un documento mai visto, ma da solo non garantisce risultati ripetibili, spesso non ricorda le correzioni e non sa nulla di archivi, duplicati o relazioni tra documenti. Sono i limiti che emergono quando una piattaforma nata solo sull'AI generativa passa dalla demo alla produzione:
- lo stesso documento elaborato due volte può dare risposte diverse, e un modello che non trova un dato tende a riempire il vuoto con un valore plausibile;
- una correzione dell'utente vale spesso solo per quel documento: per non ripeterla bisogna riscrivere il prompt o riaddestrare un modello;
- costi e tempi di elaborazione crescono con ogni pagina passata al modello;
- estrarre testo è solo l'inizio, perché un'azienda deve anche classificare, rinominare e archiviare i documenti, riconoscere i duplicati, collegare ordine, DDT e fattura e conservare tutto secondo regole precise.
Quest'ultimo punto è il più difficile da colmare. Il know-how della gestione documentale non arriva insieme a un modello linguistico: si costruisce in anni di lavoro accanto alle persone che i documenti li gestiscono davvero.
Che cosa aggiunge AIDA Boost all'estrazione dei dati?
Oggi l'estrazione dei dati la promettono quasi tutti, e un'offerta assomiglia all'altra finché non si guarda che cosa succede ai documenti veri. AIDA Boost è il modo in cui l'AI generativa potenzia il motore di AIDA, e la differenza si vede in quello che trovi già pronto quando apri un documento:
- le righe delle tabelle, come codici articolo, quantità e lotti di un DDT, arrivano già strutturate, senza configurare colonne;
- tutte le proprietà, comprese quelle specifiche della tua azienda, vengono estratte fin dal primo documento: un'estrazione zero-shot, senza addestramento, che si somma a quella appresa dall'utente;
- AIDA capisce che cosa richiede una proprietà e può riunire in un solo valore più informazioni correlate del documento;
- AIDA Boost impara dalle correzioni: quando sistemi un valore con un clic, ne tiene conto nei documenti successivi, unendo l'apprendimento di AIDA alla flessibilità dell'AI generativa;
- quando i documenti cambiano, il lavoro di controllo e correzione si riduce al minimo.
Il risultato è un'estrazione che va oltre i campi standard, su qualsiasi tipo di documento, con una configurazione che si fa dall'interfaccia in pochi clic.
La differenza pesa soprattutto sui documenti non strutturati, come la corrispondenza e gli atti che uno studio legale riceve ogni giorno (ne parliamo nell'articolo sull'innovazione legale con AIDA). Il motore Hybrid-AI di AIDA legge il testo e ne estrae la controparte, il numero del procedimento o la data dell'udienza anche da documenti mai visti prima. I valori anomali restano evidenziati per il controllo, e se un dato va corretto basta un clic perché AIDA lo impari, anche su una lettera.
Gli agenti AI di AIDA partono da qui: lavorano su documenti già classificati, letti, verificati e collegati tra loro, e calcolano totali esatti su tutto l'archivio, quindi il modello non deve mai indovinare i dati che mancano.
Template, solo AI generativa e AIDA a confronto
| Aspetto | Estrazione basata su template | Solo AI generativa | AIDA |
|---|---|---|---|
| Configurazione iniziale | Template e regole definiti da specialisti con software dedicato | Prompt o nessuna configurazione | Tipi di documento e proprietà scelti dall'interfaccia, senza codice |
| Nuovo layout di un fornitore | Nuovo template o nuove regole | Letto dal modello | Imparato alla prima conferma e riconosciuto in automatico, al massimo un clic sui valori |
| Documenti non strutturati (lettere, atti) | Quasi impossibili da descrivere | Letti dal modello, con risultati che possono variare | Letti fin dal primo documento, con le anomalie evidenziate |
| Addestramento | Separato dalla produzione | Correzioni via agenti impegnative in termini di costi token e spesso non memorizzate | Avviene mentre si confermano i documenti |
| Risultati | Stabili finché il layout non cambia | Possono variare tra due elaborazioni | Coerenti, con le anomalie evidenziate |
| Gestione documentale | Spesso affidata ad altri prodotti | Spesso limitata all'estrazione | End2End: Attività personali e agentiche, Archivio, duplicati e relazioni tra documenti inclusi |
Trent'anni di esperienza, il ritmo di una startup
AIDA nasce dall'esperienza trentennale del nostro team nella gestione documentale, dai sistemi ECM degli anni Novanta alla digitalizzazione con le multifunzioni in ogni ufficio, una storia che Giorgio, il nostro CEO, racconta nell'intervista sull'evoluzione della gestione documentale. Quell'esperienza si vede nelle funzioni che un'azienda usa ogni giorno, oltre all'estrazione:
- un archivio documentale con spazio illimitato in ogni piano e ricerca sul testo e sui dati estratti;
- il rilevamento dei duplicati dal contenuto o dai campi estratti, con la possibilità di bloccarne la convalida;
- le relazioni tra documenti, per ritrovare insieme ordine, DDT e fattura della stessa operazione;
- decine di formati di file supportati e convertiti in PDF;
- AIDA Pay, che dal documento approvato invia al cliente la richiesta di pagamento con un link o un codice QR e riconcilia l'incasso in automatico;
- automazioni e destinazioni che portano i dati nei sistemi dove servono.
Le startup nate con l'AI generativa partono da un modello linguistico e cercano di costruirci intorno la gestione documentale. AIDA ha fatto il percorso opposto: prima ha capito come le aziende lavorano con i documenti, poi ha costruito un motore che impara dalle persone, e oggi lo potenzia con l'AI generativa.
Con quell'esperienza alle spalle, AIDA evolve al ritmo di una startup: nell'ultimo anno il suo changelog conta più di 350 aggiornamenti. Tra questi ci sono AIDA 20.0, che ha portato l'AI agentica, e AIDA 20.5, AIDA Match per la riconciliazione dei documenti e la nuova AIDA Mobile 7.0. Nel 2025 AIDA ha ricevuto il premio «One to watch: Product of the Year» ai Document Manager Awards.
Domande frequenti
Che cos'è l'estrazione dati senza template?
È un metodo di estrazione che non richiede di descrivere in anticipo la posizione dei dati per ogni layout. In AIDA il tipo di documento definisce solo quali dati estrarre, e il motore impara dove trovarli dai documenti confermati dagli utenti, riconoscendo da solo ogni nuovo layout.
AIDA richiede un addestramento prima di partire?
No. Le proprietà intelligenti riconoscono date, partite IVA, IBAN e altri valori comuni senza addestramento, e con AIDA Boost tutte le proprietà vengono estratte fin dal primo documento. Se un valore va corretto, basta un clic durante il normale controllo dei documenti e AIDA lo impara.
AIDA usa l'AI generativa?
Sì. AIDA ha un motore Hybrid-AI: l'analisi del documento e l'apprendimento dall'utente, che sviluppiamo dal 2012, lavorano insieme all'AI generativa di AIDA Boost. Gli agenti AI la usano per cercare, calcolare e agire sui documenti, sempre su dati verificati dagli utenti.
Serve un programmatore per configurare AIDA?
No. Tipi di documento, proprietà, automazioni e destinazioni si impostano dall'interfaccia con pochi clic. Le API restano disponibili per i team che vogliono integrare AIDA nei propri sistemi, ma non sono necessarie.
Per vedere come AIDA impara dai tuoi documenti, scopri l'estrazione dati di AIDA oppure prenota una demo e porta i tuoi documenti reali.





