Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Analyse des factures et des reçus
Amazon Textract extrait les données pertinentes, telles que les coordonnées du fournisseur et du destinataire, de presque toutes les factures ou reçus, sans avoir besoin de modèles ou de configuration. Les factures et les reçus utilisent souvent différentes mises en page, ce qui rend difficile et fastidieuse l'extraction manuelle des données à grande échelle. Amazon Textract utilise le machine learning pour comprendre le contexte des factures et des reçus. Il extrait automatiquement des données telles que la date de facture ou de réception, le numéro de facture ou de reçu, le prix des articles, le montant total et les conditions de paiement.
Amazon Textract identifie également les noms des fournisseurs essentiels pour vos flux de travail, mais qui peuvent ne pas être étiquetés de manière explicite. Par exemple, Amazon Textract peut trouver le nom du fournisseur sur un reçu même s'il n'est indiqué que dans un logo en haut de page sans combinaison clé-valeur explicite.
Amazon Textract vous permet également de consolider facilement les entrées provenant de divers reçus et factures qui utilisent des mots différents pour désigner le même concept. Par exemple, Amazon Textract cartographie les relations entre les noms de champs dans différents documents tels que le numéro de facture, le numéro de facture, le numéro de reçu, en sortant la taxonomie standard sous la forme. INVOICE_RECEIPT_ID Dans ce cas, Amazon Textract représente les données de manière cohérente entre les différents types de documents. Les champs d'adresse sont classés comme « destinataire », « fournisseur », « fournisseur », « facture à », « expédier à » et « envoyer à ». Lorsque les documents de dépenses ne comportent pas de valeurs uniques pour chacune de ces catégories, Amazon Textract renvoie uniquement les catégories contenant des valeurs uniques.
Les champs qui ne correspondent pas à la taxonomie standard sont classés dans la catégorie. OTHER
Vous trouverez ci-dessous une liste de champs standard pris en charge par les opérations d'analyse des dépenses.
-
Date de réception de la facture —
INVOICE_RECEIPT_DATE -
Numéro de reçu de facture —
INVOICE_RECEIPT_ID -
Numéro du payeur de taxes sur la facture —
TAX_PAYER_ID -
Numéro de client —
CUSTOMER_NUMBER -
Numéro de compte —
ACCOUNT_NUMBER -
Nom du fournisseur —
VENDOR_NAME -
Nom du destinataire —
RECEIVER_NAME -
Adresse du fournisseur —
VENDOR_ADDRESS -
Adresse du destinataire —
RECEIVER_ADDRESS -
Date de commande —
ORDER_DATE -
Date d'échéance —
DUE_DATE -
Date de livraison —
DELIVERY_DATE -
Numéro de PO —
PO_NUMBER -
Modalités de paiement —
PAYMENT_TERMS -
Total —
TOTAL -
Montant dû —
AMOUNT_DUE -
Montant payé —
AMOUNT_PAID -
Sous-total —
SUBTOTAL -
Impôt —
TAX -
Frais de service —
SERVICE_CHARGE -
Pourboire —
GRATUITY -
Solde antérieur —
PRIOR_BALANCE -
Réduction —
DISCOUNT -
Frais d'expédition et de manutention —
SHIPPING_HANDLING_CHARGE -
Numéro ABN du fournisseur —
VENDOR_ABN_NUMBER -
Numéro GST du fournisseur —
VENDOR_GST_NUMBER -
Numéro PAN du fournisseur —
VENDOR_PAN_NUMBER -
Numéro de TVA du fournisseur —
VENDOR_VAT_NUMBER -
Numéro ABN du récepteur —
RECEIVER_ABN_NUMBER -
Numéro GST du récepteur —
RECEIVER_GST_NUMBER -
Numéro PAN du récepteur —
RECEIVER_PAN_NUMBER -
Numéro de TVA du destinataire —
RECEIVER_VAT_NUMBER -
Téléphone du fournisseur —
VENDOR_PHONE -
Téléphone récepteur —
RECEIVER_PHONE -
URL du fournisseur —
VENDOR_URL -
Item/Item Description de la ligne —
ITEM -
Ligne Item/Quantity —
QUANTITY -
Item/Total Prix de la ligne —
PRICE -
Item/Unit Prix de la ligne —
UNIT_PRICE -
Ligne Item/ProductCode —
PRODUCT_CODE -
Adresse (adresse de facturation, adresse de livraison, adresse de livraison, fournisseur) —
ADDRESS -
Nom (facture, adresse de livraison, adresse de livraison, fournisseur) —
NAME -
Adresse principale (fournisseur, destinataire, adresse de facturation, adresse de livraison, adresse de livraison, fournisseur) —
ADDRESS_BLOCK -
Adresse postale (fournisseur, destinataire, adresse de facturation, adresse de livraison, adresse de livraison, fournisseur) —
STREET -
Ville (fournisseur, destinataire, facture à, expédition, remise à, fournisseur) —
CITY -
État (fournisseur, destinataire, facture à, expédition, remise à, fournisseur) —
STATE -
Pays (fournisseur, destinataire, facture, adresse de livraison, adresse de livraison, fournisseur) —
COUNTRY -
Code postal (fournisseur, destinataire, facture à, expédition, envoi à, fournisseur) —
ZIP_CODE
L' AnalyzeExpense API renvoie les éléments suivants pour une page de document donnée :
-
Le nombre de reçus ou de factures dans un document représenté par
ExpenseIndex -
Le nom normalisé pour les champs individuels représentés par
Type -
Le nom réel du champ tel qu'il apparaît sur le document, représenté par
LabelDetection -
La valeur du champ correspondant représenté par
ValueDetection -
Le nombre de pages du document soumis représenté par
Pages -
Numéro de page sur lequel le champ, la valeur ou les éléments de ligne sont détectés, représenté par
PageNumber -
La géométrie, qui inclut le cadre de délimitation et les coordonnées de l'emplacement de chaque champ, valeur ou élément de ligne sur la page, représentée par
Geometry -
Le score de confiance associé à chaque donnée détectée sur le document, représenté par
Confidence -
La rangée complète des articles individuels achetés, représentée par
EXPENSE_ROW
Voici une partie de la sortie de l'API pour un reçu traité par AnalyzeExpense qui indique le total : 55,64$ dans le document extrait en tant que champ standard. TOTAL Le texte réel du document apparaît comme « Total », le score de confiance comme « 97,1 », le numéro de page comme « 1 » et la valeur totale comme « 55,64$ ». Cela inclut également le cadre de délimitation et les coordonnées du polygone :
{ "Type": { "Text": "TOTAL", "Confidence": 99.94717407226562 }, "LabelDetection": { "Text": "Total:", "Geometry": { "BoundingBox": { "Width": 0.09809663146734238, "Height": 0.0234375, "Left": 0.36822840571403503, "Top": 0.8017578125 }, "Polygon": [ { "X": 0.36822840571403503, "Y": 0.8017578125 }, { "X": 0.466325044631958, "Y": 0.8017578125 }, { "X": 0.466325044631958, "Y": 0.8251953125 }, { "X": 0.36822840571403503, "Y": 0.8251953125 } ] }, "Confidence": 97.10792541503906 }, "ValueDetection": { "Text": "$55.64", "Currency": { "Code": USD } "Geometry": { "BoundingBox": { "Width": 0.10395314544439316, "Height": 0.0244140625, "Left": 0.66837477684021, "Top": 0.802734375 }, "Polygon": [ { "X": 0.66837477684021, "Y": 0.802734375 }, { "X": 0.7723279595375061, "Y": 0.802734375 }, { "X": 0.7723279595375061, "Y": 0.8271484375 }, { "X": 0.66837477684021, "Y": 0.8271484375 } ] }, "Confidence": 99.85165405273438 }, "PageNumber": 1 }
Vous pouvez utiliser des opérations synchrones pour analyser une facture ou un reçu. Pour analyser ces documents, vous utilisez l' AnalyzeExpense opération et vous leur transmettez un reçu ou une facture. AnalyzeExpenserenvoie l'ensemble complet des résultats. Pour de plus amples informations, veuillez consulter Analyse des factures et des reçus avec Amazon Textract.
Pour analyser les factures et les reçus de manière asynchrone, utilisez cette option StartExpenseAnalysispour démarrer le traitement d'un fichier de document d'entrée. Pour obtenir les résultats, appelez GetExpenseAnalysis. Les résultats d'un appel donné StartExpenseAnalysissont renvoyés parGetExpenseAnalysis. Pour plus d'informations et pour voir un exemple, consultez Traitement asynchrone des documents.