Mejor plana que nítida
El reconocimiento de texto funciona comparando formas de letras. En una página curvada, la misma letra es alta cerca del margen exterior y estrecha cerca del margen interior, y un modelo que tiene que adivinar cuál es cuál acaba cometiendo errores. Aplana primero la página y todas las letras de la línea vuelven a tener las mismas proporciones. Es el factor que más influye, y por eso vFlat aplana la página antes del reconocimiento y no después.
La luz importa más que los megapíxeles
La cámara de un móvil actual tiene mucha más resolución de la que necesita el reconocimiento. Lo que no tiene es control sobre la luz de la habitación. Una luz uniforme y difusa desde un lado da trazos limpios; una sola lámpara intensa provoca reflejos en el papel satinado y proyecta la sombra de tu mano o del móvil sobre el texto. Si un escaneo se lee mal, mueve el libro, no los ajustes.
Llena el encuadre y mantén el móvil recto
La perspectiva se corrige automáticamente, pero una página que llena el encuadre tiene sencillamente más píxeles por letra que una que ocupa solo una esquina. Acércate, mantén el móvil más o menos paralelo a la página y deja que la detección automática encuentre los bordes.
Dile qué idiomas va a leer
El reconocimiento abarca más de 100 idiomas, y las páginas mixtas —coreano con términos en inglés, japonés con números— se leen bien. Aun así, ayuda tener seleccionados los idiomas correctos: el modelo centra su confianza en los alfabetos que de verdad usas en lugar de repartirla entre todos los que conoce.
Comprueba la capa de texto una vez
Después del reconocimiento, busca en el escaneo algunas palabras que sepas que están en la página: cerca de la parte superior, junto al margen interior y en el margen inferior. Si aparecen todas, la página está bien. Si faltan algunas, el problema casi siempre está en la captura —una sombra, un reflejo o una página que no estaba plana—, y repetir la foto lo soluciona más rápido que cualquier corrección posterior.
