Un PDF escaneado es una fotografía de un documento. Para ti parece texto y para el ordenador son solo píxeles, y por eso buscar no encuentra nada, seleccionar no selecciona nada y copiar no copia nada. Esto pone texto real detrás de la imagen, y las tres cosas empiezan a funcionar.
Lo importante es lo que no hace: no redibuja tu página. La imagen queda exactamente como estaba, y las palabras reconocidas quedan invisibles detrás. Por eso un documento procesado aquí se ve idéntico después, y por eso el modo de fallo es una palabra mal reconocida en una búsqueda y no una página que de pronto se ve distinta.
La precisión depende de lo que le des. Texto impreso limpio sale casi perfecto. Una fotocopia de tercera generación o notas a mano tendrán errores, y cuando la página no está lo bastante clara para leerse bien la herramienta lo dice en vez de escribir palabras adivinadas detrás de tu escaneo — busca un nombre que tengas claro que está en el documento y sabrás en segundos qué tal fue.
Dos cosas sobre honestidad aquí. Primero: si una página ya tiene texto de verdad, no se lee — reconocer sobre texto correcto cambia algo seguro por una suposición, y el panel cuenta solo las páginas que son solo una imagen antes de empezar nada. Segundo: en un documento mitad escrito y mitad fotocopiado — un contrato con la página de firma escaneada, por ejemplo — solo se leen las páginas escaneadas. Las escritas ya están bien.
Y todo ocurre en tu dispositivo. La página se renderiza, se lee y se reconstruye dentro de tu navegador; no se sube nada, y los modelos de idioma también viven aquí — por eso hoy solo se ofrecen inglés y español y no una lista larga que no podríamos mantener en tu máquina. Detener la lectura deja el archivo exactamente como estaba, byte a byte.