Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Prácticas recomendadas
Amazon Textract utiliza el aprendizaje automático para leer documentos como lo haría una persona. Extrae texto, tablas y formularios de los documentos. Utilice las siguientes prácticas recomendadas para obtener los mejores resultados de sus documentos.
Proporcione un documento de entrada óptimo
Una entrada adecuada para una operación de Amazon Textract es un documento de una o varias páginas. Algunos ejemplos son un documento legal, un formulario, un documento de identidad o una carta. Un formulario es un documento con preguntas o indicaciones para que el usuario dé respuestas. Algunos ejemplos son un formulario de registro de pacientes, un formulario de impuestos o un formulario de reclamación de seguro.
Un documento puede estar en formato JPEG, PNG, PDF o TIFF. Con los archivos en formato PDF y TIFF, puede procesar documentos de varias páginas. Para obtener información sobre cómo Amazon Textract representa los documentos como Block objetos, consulte. Objetos de respuesta para la detección de texto y el análisis de documentos
El siguiente es un ejemplo de documento de entrada aceptable.
Para obtener información sobre los límites de los documentos, consulteCuotas en Amazon Textract.
Para las operaciones sincrónicas de Amazon Textract, puede utilizar documentos de entrada almacenados en un bucket de Amazon S3 o puede pasar bytes de imagen codificados en base64. Para obtener más información, consulte Llamar a Amazon Textract Synchronous Operations. Para las operaciones asíncronas, debe proporcionar los documentos de entrada en un bucket de Amazon S3. Para obtener más información, consulte Llamar a Amazon Textract Asynchronous Operations.
La siguiente es una lista de algunas maneras en las que puede optimizar sus documentos de entrada para obtener mejores resultados.
Asegúrese de que el texto del documento esté en un idioma compatible con Amazon Textract. Actualmente, Amazon Textract admite inglés, español, alemán, italiano, francés y portugués.
Proporcione una imagen de alta calidad, idealmente de al menos 150 DPI.
Si el documento ya está en uno de los formatos de archivo compatibles con Amazon Textract (PDF, TIFF, JPEG y PNG), no convierta ni reduzca la resolución del documento antes de subirlo a Amazon Textract.
Para obtener los mejores resultados al extraer texto de las tablas de los documentos, asegúrese de lo siguiente:
Las tablas del documento se separan visualmente de los elementos circundantes de la página. Por ejemplo, la tabla no está superpuesta sobre una imagen o un patrón complejo.
El texto de la tabla está en posición vertical. Por ejemplo, el texto no está girado en relación con el resto del texto de la página.
Al extraer texto de las tablas, es posible que veas resultados incoherentes cuando:
Celdas de tabla combinadas que ocupan varias columnas.
Tablas con celdas, filas o columnas distintas de otras partes de la misma tabla.
Se recomienda utilizar la detección de texto como solución alternativa.
Utilice puntuaciones de confianza
Debe tener en cuenta las puntuaciones de confianza devueltas por las operaciones de la API de Amazon Textract y la sensibilidad de su caso de uso. Una puntuación de confianza es un número entre 0 y 100 que indica la probabilidad de que una predicción determinada sea correcta. Le ayuda a tomar decisiones informadas sobre cómo utilizar los resultados.
En las aplicaciones sensibles a los errores de detección (falsos positivos), aplique un umbral mínimo de puntuación de confianza. La aplicación debe descartar los resultados por debajo de ese umbral o señalar las situaciones que requieren un mayor nivel de escrutinio humano.
El umbral óptimo depende de la aplicación. Para fines de archivo, como documentar notas manuscritas, puede ser tan bajo como el 50%. Los procesos empresariales que implican decisiones financieras pueden requerir umbrales del 90% o más.