Contexto LATAM
Los bancos modernos en LATAM generalmente entregan PDFs nativos desde su banca en línea. Sin embargo, algunos formatos viejos o impresiones re-escaneadas (cuando el cliente imprime y vuelve a digitalizar) requieren OCR para extracción.
Ejemplo concreto
Un PDF de BBVA México descargado desde Net Cash es nativo: puedes seleccionar y copiar texto. Un PDF que recibiste por WhatsApp tras imprimirlo y volverlo a escanear es escaneado y necesita OCR.
Cómo aparece en tu estado de cuenta
Es la primera cosa que conviene mirar antes de procesar un lote de estados. Un PDF nativo lleva el texto dentro del archivo y se lee con exactitud; uno escaneado es una imagen y hay que reconstruir cada carácter. Un mismo banco puede entregar los dos formatos según el canal: el descargado de la banca en línea suele ser nativo, y el que imprimen en sucursal deja de serlo en cuanto lo escaneás.
¿Cómo lo maneja finO$?
finO$ detecta automáticamente el tipo de PDF: nativos van directo a parsing estructurado (más rápido, precisión 99%+). Escaneados pasan por OCR primero (precisión 97%+ en buena calidad).