tidy.
Escritos

Por qué Spotlight no encuentra el texto de tus PDF escaneados

Sebastián Díaz Thomas · Santiago, Chile · septiembre 2026

Buscas en tu Mac una palabra que estás seguro de que aparece en un documento que escaneaste el año pasado. Spotlight no devuelve nada. Pruebas con otra palabra. Tampoco. Empiezas a pensar que el archivo se dañó, o que hay que reconstruir el índice.

El archivo está bien y el índice está bien. Sencillamente, en ese documento no hay nada que Spotlight pueda leer.

Qué es en realidad un PDF escaneado

Dos cosas muy distintas se llaman PDF.

Un PDF que salió de Word, o del «Guardar como PDF» del navegador, contiene texto como texto. Las letras están guardadas como letras. Spotlight las lee, las indexa y las encuentra.

Un PDF que salió de un escáner, de la cámara del teléfono o de una app de escaneo es una fotografía de una hoja envuelta en un contenedor PDF. No hay letras ahí dentro. Hay píxeles ordenados con forma de letras, que para un computador es una cosa completamente distinta.

Spotlight no está fallando al leer las palabras. No hay palabras. Indexó el archivo correctamente y el archivo contiene una imagen.

La comprobación de treinta segundos

Abre el documento en Vista Previa y arrastra el cursor sobre una línea de texto. Si las palabras se marcan, hay capa de texto. Si solo dibujas un rectángulo sobre la página, no la hay.

Para revisar una carpeta entera de una vez, en el Terminal:

for f in *.pdf; do
  strings "$f" | grep -qm1 "/Type/Font" || echo "sin capa de texto: $f"
done

Un PDF que contiene texto real lleva objetos de fuente dentro. Una fotografía de una página no lleva ninguno, así que todo lo que esto imprima es un escaneo que ninguna búsqueda de tu Mac puede leer. Pásalo por tu carpeta de documentos y cuenta las líneas. Para la mayoría de la gente, el número sorprende.

Una advertencia, para que no confíes en esto más de lo que merece: algunos PDF comprimen su estructura interna y pueden aparecer como si no tuvieran texto cuando sí lo tienen. La prueba de Vista Previa de más arriba es la que nunca miente. Usa el comando para un recuento aproximado, no para dictar sentencia sobre un archivo.

Arreglo 1: añadirle una capa de texto al archivo

Es la solución clásica. Un programa de OCR lee la imagen y escribe el texto reconocido de vuelta en el PDF, como una capa invisible que queda justo encima del dibujo de cada palabra. El documento se ve idéntico y pasa a comportarse como un PDF normal: Spotlight lo indexa, Vista Previa te deja seleccionar y copiar, y la búsqueda funciona en todo el Mac.

La mayoría del software de escáner lo hace si activas la opción, y vale la pena activarla antes de escanear las próximas mil páginas. Las aplicaciones dedicadas de OCR se defienden mejor con originales difíciles.

El problema: solo sirve para los archivos que proceses. Los escaneos que ya están en tu Mac siguen invisibles hasta que vuelvas atrás y los pases todos, que es esa clase de tarea que nunca ocurre.

Arreglo 2: extraer el texto tú mismo

macOS sabe leer imágenes de fábrica. En la app Atajos hay una acción Extraer texto de la imagen que se ejecuta en tu Mac, sin cuenta y sin subir nada: el mismo reconocimiento que mueve a Texto en Vivo cuando seleccionas palabras dentro de una foto.

Puedes armar un atajo que reciba una imagen y te devuelva su texto, y luego hacer con él lo que quieras. Es gratis y es local. Práctico para un documento suelto; agotador como respuesta para una carpeta de seiscientos.

Arreglo 3: mantener un índice aparte

En vez de modificar tus archivos, una aplicación puede leer cada documento una vez, guardar el texto reconocido en su propio índice y buscar ahí. No se escribe nada dentro del PDF, y la búsqueda pasa a ser instantánea porque la lectura ya ocurrió.

Es el camino que toman gestores documentales como DEVONthink, y es el que tomé en Tidy. La diferencia entre unos y otros suele estar en dónde tienen que vivir los documentos: algunas herramientas exigen importarlo todo a su propia biblioteca, y otras leen tus archivos donde ya están.

Esa distinción importa más de lo que parece. Si la herramienta se queda con tus documentos, irte de ella es una migración. Si solo los lee, irte es arrastrar la app a la Papelera y tus carpetas quedan exactamente como estaban.

Qué haría yo

Si tu problema es de aquí en adelante, activa el OCR en lo que sea que escanee tus documentos. Es el arreglo más limpio y mejora los archivos para siempre, con independencia de cualquier app.

Si tu problema es el montón que ya tienes, un índice es más rápido, porque no te pide reprocesar y volver a guardar miles de archivos. Y elijas lo que elijas, comprueba primero si tus escaneos tienen capa de texto, porque si la tienen, nada de esto es tu problema y lo que falla es otra cosa.


La app que hago se llama Tidy. Lee lo que hay dentro de tus imágenes y de tus PDF escaneados con el reconocimiento de texto del propio equipo, le pone a cada archivo un nombre sacado de su contenido, y te deja buscar dentro de ellos desde cualquier parte con un atajo de teclado — incluidos los escaneos que Spotlight no ve. Tus archivos se quedan donde están, en sus propias carpetas. 9 dólares, pago único, sin suscripción, macOS 14 o superior, y nada sale de tu Mac.

También vale la pena leer: Renombrar PDF escaneados · Ordenar la carpeta Descargas · Tidy y Hazel, lado a lado

Este artículo en: English · Español · Deutsch · Français · Português