Aperçu
L'intelligence documentaire extrait et justifie le texte, la mise en page, les tableaux, les images et l'écriture manuscrite tout en conservant les liens vers les preuves au niveau de la page et les contrôles de flux de travail en aval.
Matchpoint se rapproche du AI en tant que capacité opérationnelle avec des propriétaires responsables, des portes de décision explicites, des critères d'acceptation mesurables, une architecture documentée et un chemin pratique de la découverte à la production.
Les documents complexes codent le sens à travers la mise en page ainsi que le langage. Les tableaux, colonnes, en-têtes, notes de bas de page, écriture manuscrite, diagrammes, signatures et champs voisins peuvent modifier l'interprétation du texte. Nous modélisons cette structure explicitement au lieu de nous appuyer sur un flux de texte aplati.
La conception de la solution peut combiner l'OCR, des modèles de mise en page, des modèles de langage de vision, une extraction déterministe, des taxonomies de documents et un examen fondé sur des preuves. Les résultats requis peuvent aller des champs structurés et des rapprochements à la comparaison, à la classification, à la synthèse et aux réponses aux questions de documents dans un corpus.
La suite d'acceptation représente la variation des documents trouvée en production : différents modèles, numérisations, tableaux, écriture manuscrite, pages manquantes, images de mauvaise qualité, champs conflictuels et documents longs. La précision, la couverture, l'emplacement des preuves, la confiance et le routage des exceptions sont mesurés séparément afin que les utilisateurs sachent quels résultats peuvent être transmis et lesquels doivent être examinés.