🔎
Más
Especiales
Filtros
IA hace 1 h

Tidy, app para Mac que nombra archivos según contenido

Tidy, app para Mac que nombra archivos según contenido

La búsqueda de documentos en Mac puede fallar si los archivos PDF están escaneados y no contienen texto editable. Esto se debe a que los PDF escaneados son imágenes de páginas y no contienen caracteres que puedan ser leídos por Spotlight.

Los PDF pueden ser de dos tipos: aquellos que contienen texto editable, como los creados con Word o mediante la función "Imprimir a PDF" de un navegador, y aquellos que son imágenes de páginas, como los creados con un escáner o una cámara. Los primeros pueden ser indexados y buscados por Spotlight, mientras que los segundos no. Para comprobar si un PDF contiene una capa de texto, se puede abrir en Preview y arrastrar el cursor sobre una línea de texto. Si las palabras se resaltan, hay una capa de texto. También se puede utilizar el Terminal para comprobar si un PDF contiene una capa de texto.

“Los primeros pueden ser indexados y buscados por Spotlight, mientras que los segundos no”

Para solucionar el problema de los PDF escaneados, hay varias opciones. Una de ellas es agregar una capa de texto al archivo mediante un programa de OCR (reconocimiento óptico de caracteres). Esto permite que Spotlight indexe el archivo y que se pueda buscar texto dentro de él. Otra opción es utilizar la aplicación "Atajos" para extraer el texto de la imagen. Sin embargo, esta opción es más laboriosa y solo es práctica para documentos ocasionales. Una tercera opción es utilizar una aplicación que cree un índice separado de los documentos, como DEVONthink o Tidy, que pueden leer los archivos PDF y crear un índice de texto sin modificar los archivos originales.

La elección de la solución depende del problema específico que se esté tratando de resolver. Si el problema es la búsqueda de texto en documentos futuros, la mejor opción es activar la función de OCR en el escáner o la cámara. Si el problema es la búsqueda de texto en un gran número de documentos ya existentes, la creación de un índice separado puede ser la solución más rápida y eficiente. En cualquier caso, es importante comprobar primero si los PDF escaneados contienen una capa de texto, ya que si la contienen, no es necesario tomar ninguna medida adicional.

Más sobre IA