Servicio que extrae texto, tablas y datos de formularios directamente de documentos escaneados o PDFs, yendo más allá de un OCR tradicional al entender la estructura del documento (pares clave-valor, tablas).
En AIF-C01 (Dominio 3) se diferencia de un OCR genérico porque preserva la estructura de formularios y tablas. Pregunta: automatizar la extracción de datos de facturas escaneadas conservando el formato de tabla → Amazon Textract.