AIDA
10/7/2026

Extração de dados sem templates, de 2012 à IA generativa

Moduli e documenti con layout diversi su una scrivania

A extração de dados sem templates é a razão de ser da AIDA: a nossa plataforma de intelligent document processing (IDP) nasceu em 2012, dez anos antes do ChatGPT, para ler os dados dos documentos aprendendo com o utilizador num clique, em vez de exigir modelos construídos à mão. Hoje a IA generativa potencia esse motor, que continua a ser a base de todo o produto.

Quem escolhe hoje um software de IDP depara-se muitas vezes com dois tipos de propostas. De um lado, as plataformas históricas, nascidas da extração baseada em templates. Do outro, as startups dos últimos três anos, que confiam tudo a um modelo de linguagem e mostram demos convincentes na primeira fatura. A AIDA vem de um caminho diferente, e conhecê-lo ajuda a perceber o que acontece depois da demo, quando entram em jogo milhares de documentos reais.

O que era a extração de dados baseada em templates?

A extração baseada em templates descreve antecipadamente onde se encontra cada dado num determinado layout de documento: desenham-se zonas ou escrevem-se regras que procuram palavras-chave e posições relativas, e depois o software aplica essa descrição aos documentos recebidos.

Em 2012, o mercado da captura de dados era liderado pela ABBYY e pela Kofax (hoje Tungsten Automation), com plataformas poderosas construídas sobre este princípio. No ABBYY FlexiCapture, a estrutura dos documentos de layout variável descreve-se com um programa dedicado, o FlexiLayout Studio; no Kofax Transformation Modules, os projetos de extração preparam-se e testam-se no Project Builder, para o qual existem cursos de formação específicos.

Quem acompanhou um projeto de captura documental nesses anos recorda bem os seus limites:

  • a configuração exigia técnicos especializados, software e formação dedicados, antes mesmo de processar o primeiro documento;
  • cada novo fornecedor com um layout diferente significava um novo template ou novas regras para escrever;
  • com os documentos não estruturados, como as cartas ou as peças processuais de um escritório de advogados, o template não tinha pontos fixos onde se apoiar, porque o dado podia estar em qualquer frase do texto;
  • treino e produção eram processos separados: o projeto preparava-se num ambiente de design, publicava-se em produção e cada alteração repetia o mesmo percurso;
  • um layout que mudasse, mesmo ligeiramente, podia comprometer a extração, até alguém atualizar o template.

Como funciona a extração de dados sem templates da AIDA?

A AIDA aprende com o utilizador enquanto ele trabalha: para lhe ensinar um campo basta selecionar a propriedade e clicar no valor no documento. Um clique num único documento, e a partir desse momento a AIDA sabe o que procurar nos documentos seguintes do mesmo tipo.

Na AIDA, o tipo de documento não depende do aspeto gráfico, mas apenas dos dados que pretende extrair. Uma fatura de fornecedor continua a ser uma fatura de fornecedor, quer chegue do fornecedor A ou do fornecedor B com um layout completamente diferente.

Quando confirma o primeiro documento com um layout novo, a AIDA aprende a lê-lo; quando chega outro documento com um layout igual ou semelhante, reconhece-o sozinha. Ninguém tem de desenhar um template, dar-lhe um nome ou indicar qual usar para cada documento, nem mesmo quando os fornecedores são centenas.

Muitas soluções reconhecem uma lista fixa de campos padrão, como fornecedor, número, data e valores de uma fatura. As propriedades inteligentes da AIDA sempre reconheceram datas, números de contribuinte, IBAN e outros valores comuns sem treino, mas os dados que contam para uma empresa são muitas vezes outros: o número da obra, o centro de custo, a matrícula do veículo, o código CPE de uma fatura de eletricidade. A AIDA também aprende esses, com um clique, em qualquer tipo de documento, e com o AIDA Boost encontra-os logo no primeiro.

As propriedades inteligentes e a aprendizagem com um clique não dependem de um modelo de linguagem: assentam numa análise minuciosa da estrutura do documento, que desenvolvemos desde 2012. O algoritmo da AIDA reproduz a forma como uma pessoa reconhece um documento e identifica as suas informações-chave. Esta abordagem é única no mercado e é a base sólida que o AIDA Boost potencia, sem a substituir.

A diferença mais profunda em relação aos sistemas da época é que treino e produção coincidem. O operador abre um documento pendente, verifica os valores propostos, clica nos que faltam ou que precisam de correção e confirma. A confirmação arquiva o documento ou envia-o para o destino escolhido e, com o mesmo gesto, consolida o que a AIDA aprendeu. Não são precisos um ambiente de design separado nem um consultor que volte a publicar o projeto.

Em 2012 era uma abordagem disruptiva, e a razão pela qual funciona continua a ser a mesma: quem conhece verdadeiramente os documentos é quem trabalha com eles todos os dias, não quem configura o software. A AIDA põe a aprendizagem nas mãos dessa pessoa, sem código e sem formação especializada. Era human in the loop muito antes de a IA generativa tornar a expressão comum.

Quando os resultados estão estáveis, uma regra de automação pode confirmar os documentos sozinha, enquanto a AIDA assinala a amarelo os valores anómalos a verificar. Encontra os detalhes na página sobre a extração automática de dados com a AIDA.

Porque é que a IA generativa sozinha não chega na gestão documental?

Um modelo de linguagem lê bem até um documento que nunca viu, mas sozinho não garante resultados repetíveis, muitas vezes não se lembra das correções e não sabe nada de arquivos, duplicados ou relações entre documentos. São os limites que surgem quando uma plataforma construída apenas sobre IA generativa passa da demo à produção:

  • o mesmo documento processado duas vezes pode dar respostas diferentes, e um modelo que não encontra um dado tende a preencher o vazio com um valor plausível;
  • uma correção do utilizador vale muitas vezes apenas para aquele documento: para não a repetir é preciso reescrever o prompt ou voltar a treinar um modelo;
  • os custos e os tempos de processamento crescem com cada página enviada ao modelo;
  • extrair texto é só o início, porque uma empresa também tem de classificar, renomear e arquivar os documentos, reconhecer os duplicados, ligar encomenda, guia de remessa e fatura e conservar tudo segundo regras precisas.

Este último ponto é o mais difícil de colmatar. O know-how da gestão documental não vem incluído num modelo de linguagem: constrói-se em anos de trabalho ao lado das pessoas que gerem realmente os documentos.

O que acrescenta o AIDA Boost à extração de dados?

Hoje quase todos prometem extração de dados, e uma oferta parece-se com outra até se observar o que acontece aos documentos reais. O AIDA Boost é a forma como a IA generativa potencia o motor da AIDA, e a diferença vê-se naquilo que encontra já pronto quando abre um documento:

  • as linhas das tabelas, como códigos de artigo, quantidades e lotes de uma guia de remessa, chegam já estruturadas, sem configurar colunas;
  • todas as propriedades, incluindo as específicas da sua empresa, são extraídas logo a partir do primeiro documento: uma extração zero-shot, sem treino, que se soma à aprendida com o utilizador;
  • a AIDA percebe o que uma propriedade exige e pode reunir num só valor várias informações relacionadas do documento;
  • o AIDA Boost aprende com as correções: quando corrige um valor com um clique, tem-no em conta nos documentos seguintes, unindo a aprendizagem da AIDA à flexibilidade da IA generativa;
  • quando os documentos mudam, o trabalho de verificação e correção reduz-se ao mínimo.

O resultado é uma extração que vai além dos campos padrão, em qualquer tipo de documento, com uma configuração feita a partir da interface em poucos cliques.

A diferença pesa sobretudo nos documentos não estruturados, como a correspondência e as peças processuais que um escritório de advogados recebe todos os dias (falamos disso no artigo sobre a inovação jurídica com a AIDA). O motor Hybrid-AI da AIDA lê o texto e extrai a parte contrária, o número do processo ou a data da audiência, mesmo de documentos nunca vistos antes. Os valores anómalos continuam assinalados para verificação e, se um dado tiver de ser corrigido, basta um clique para que a AIDA o aprenda, mesmo numa carta.

Os agentes de IA da AIDA partem daqui: trabalham sobre documentos já classificados, lidos, verificados e ligados entre si, e calculam totais exatos em todo o arquivo, por isso o modelo nunca tem de adivinhar os dados em falta.

Templates, só IA generativa e AIDA em comparação

Aspeto Extração baseada em templates Só IA generativa AIDA
Configuração inicial Templates e regras definidos por especialistas com software dedicado Prompt ou nenhuma configuração Tipos de documento e propriedades escolhidos a partir da interface, sem código
Novo layout de um fornecedor Novo template ou novas regras Lido pelo modelo Aprendido na primeira confirmação e reconhecido automaticamente, no máximo um clique nos valores
Documentos não estruturados (cartas, peças processuais) Quase impossíveis de descrever Lidos pelo modelo, com resultados que podem variar Lidos logo a partir do primeiro documento, com as anomalias assinaladas
Treino Separado da produção Correções através de agentes, dispendiosas em custos de tokens e muitas vezes não memorizadas Acontece enquanto se confirmam os documentos
Resultados Estáveis enquanto o layout não muda Podem variar entre dois processamentos Coerentes, com as anomalias assinaladas
Gestão documental Muitas vezes entregue a outros produtos Muitas vezes limitada à extração End2End: tarefas pessoais e agênticas, arquivo, duplicados e relações entre documentos incluídos

Trinta anos de experiência, o ritmo de uma startup

A AIDA nasce da experiência de trinta anos da nossa equipa em gestão documental, dos sistemas ECM dos anos noventa à digitalização com as multifuncionais em todos os escritórios, uma história que o Giorgio, o nosso CEO, conta na entrevista sobre a evolução da gestão documental. Essa experiência vê-se nas funcionalidades que uma empresa usa todos os dias, para além da extração:

  • um arquivo documental com espaço ilimitado em todos os planos e pesquisa no texto e nos dados extraídos;
  • a deteção de duplicados a partir do conteúdo ou dos campos extraídos, com a possibilidade de bloquear a sua validação;
  • as relações entre documentos, para encontrar em conjunto a encomenda, a guia de remessa e a fatura da mesma operação;
  • dezenas de formatos de ficheiro suportados e convertidos em PDF;
  • o AIDA Pay, que a partir do documento aprovado envia ao cliente o pedido de pagamento com um link ou um código QR e reconcilia o recebimento automaticamente;
  • automações e destinos que levam os dados para os sistemas onde são necessários.

As startups nascidas com a IA generativa partem de um modelo de linguagem e tentam construir à volta dele a gestão documental. A AIDA fez o percurso inverso: primeiro percebeu como as empresas trabalham com os documentos, depois construiu um motor que aprende com as pessoas, e hoje potencia-o com a IA generativa.

Com essa experiência por trás, a AIDA evolui ao ritmo de uma startup: no último ano, o seu changelog conta mais de 350 atualizações. Entre elas estão o AIDA 20.0, que trouxe a IA agêntica, e o AIDA 20.5, o AIDA Match para a reconciliação de documentos e a nova AIDA Mobile 7.0. Em 2025, a AIDA recebeu o prémio «One to watch: Product of the Year» nos Document Manager Awards.

Perguntas frequentes

O que é a extração de dados sem templates?

É um método de extração que não exige descrever antecipadamente a posição dos dados para cada layout. Na AIDA, o tipo de documento define apenas que dados extrair, e o motor aprende onde encontrá-los a partir dos documentos confirmados pelos utilizadores, reconhecendo sozinho cada novo layout.

A AIDA exige treino antes de começar?

Não. As propriedades inteligentes reconhecem datas, números de contribuinte, IBAN e outros valores comuns sem treino, e com o AIDA Boost todas as propriedades são extraídas logo a partir do primeiro documento. Se um valor tiver de ser corrigido, basta um clique durante a verificação normal dos documentos e a AIDA aprende-o.

A AIDA usa IA generativa?

Sim. A AIDA tem um motor Hybrid-AI: a análise do documento e a aprendizagem com o utilizador, que desenvolvemos desde 2012, trabalham em conjunto com a IA generativa do AIDA Boost. Os agentes de IA usam-na para pesquisar, calcular e agir sobre os documentos, sempre com dados verificados pelos utilizadores.

É preciso um programador para configurar a AIDA?

Não. Tipos de documento, propriedades, automações e destinos configuram-se a partir da interface em poucos cliques. As APIs continuam disponíveis para as equipas que querem integrar a AIDA nos seus sistemas, mas não são necessárias.

Para ver como a AIDA aprende com os seus documentos, descubra a extração de dados da AIDA ou marque uma demo e traga os seus documentos reais.

Fulvio Molinengo - CTO
Fulvio Molinengo
CTO
 Voltar