Contexto LATAM
En LATAM muchos bancos regionales y algunos formatos viejos entregan PDFs escaneados (no nativos digitales). OCR es necesario para extraer datos de estos documentos. La precisión moderna en español supera 98% en escaneos de buena calidad.
Ejemplo concreto
Un PDF escaneado de Banco del Bajío de 2018 se procesa con OCR primero (convirtiendo la imagen en texto) y luego con parsing estructurado (interpretando el layout de columnas como movimientos).
Cómo aparece en tu estado de cuenta
El OCR no aparece en el estado: es lo que hace falta para leerlo cuando el PDF es una imagen. Si al abrir el archivo no podés seleccionar el texto con el cursor, ese PDF necesita OCR. Es el caso típico del estado que te imprimieron en sucursal y escaneaste, o de la foto tomada con el teléfono.
¿Cómo lo maneja finO$?
finO$ aplica OCR automáticamente cuando detecta un PDF escaneado o de baja calidad. Para PDFs nativos (mayoría de bancos modernos) salta OCR y va directo a parsing estructurado, mejorando velocidad y precisión.