Extraer texto de PDF

Procesado en este navegador

Límite de archivo: 32 MB

Esta herramienta no sube tu entrada.

Suelta un archivo

Suelta un archivo aquí o elige uno.

Ejemplo: elige un PDF en este dispositivo y pulsa Procesar. El archivo no se sube.

La primera vez puede descargar una biblioteca en este navegador.

Lee las letras que el PDF ya trae embebidas y te las deja en texto plano. Si la página es solo una foto, esta herramienta no inventa palabras: eso es OCR.

Quieres citar un párrafo de un informe que sí tiene texto digital, no fotografiarlo. Esta página vuelca esa capa.

No lee sellos ni DNI escaneados. El OCR es otra intención y, hoy, va primero en inglés.

Cuándo

  • Copiar cláusulas de un PDF exportado de Word.
  • Buscar una cifra en un informe nativo.
  • Pegar un temario que no es imagen.

Cómo

  1. Suelta el PDF (unos 32 MB).
  2. Copia el texto. Si sale basura, el archivo era un escaneo o tenía fuentes raras.
  3. Limpia saltos con limpiar espacios si hace falta.

Límites

  • PDF protegido puede fallar.
  • No es OCR ni PDF a Word.
  • Un resultado de nuestro compresor JPEG ya no tiene capa útil.

Extracción local.

Preguntas frecuentes

El PDF es un escaneo y sale vacío.

No hay capa de texto. Prueba OCR sobre una imagen de la página (el motor va primero en inglés) o exporta a JPG y luego OCR.

¿Es lo mismo que comprimir?

No. Tras comprimir PDF (redibujado JPEG) el texto seleccionable suele desaparecer de la copia nueva.

¿Se sube el contrato?

No. La extracción corre en esta pestaña.

¿Mantiene tablas y columnas?

El orden de lectura del PDF a veces mezcla columnas. Revisa el pegado.

¿Hace un Word editable?

No. Sale texto, no un .docx maquetado.

Herramientas relacionadas