How to Extract Text From a PDF, Even a Scanned One
Need the words out of a PDF? Learn the difference between text and scanned PDFs, four ways to copy text, and what to do when it will not select.
Read article →Copia todo el texto de un PDF de una vez y guárdalo como archivo de texto sin formato que puedes editar en cualquier parte.
Es útil para citar, traducir, buscar o pegar un documento en un editor. El archivo de texto se guarda en UTF-8, así que los acentos y los alfabetos no latinos se muestran correctamente.
Esta herramienta lee el texto que ya existe dentro del PDF. Un documento escaneado es solo una imagen de texto, así que no contiene nada que extraer y necesitaría OCR, que esta herramienta no hace. El formato, como tablas y columnas, no se conserva en texto sin formato.
Se abre en cualquier editor y en cualquier dispositivo.
Los acentos y los alfabetos no latinos se muestran bien.
Marca opcionalmente dónde empieza cada página.
Te avisa cuando un archivo no tiene texto seleccionable.
Probablemente el PDF es un escaneo o está hecho de imágenes. Esos necesitan un programa de OCR para reconocer las letras.
El texto se extrae línea por línea. El texto sin formato no puede mantener el diseño de las tablas.
Sí, siempre que el PDF guarde texto real. La salida es UTF-8.
Por ahora, nuestras guías solo están disponibles en inglés.
Need the words out of a PDF? Learn the difference between text and scanned PDFs, four ways to copy text, and what to do when it will not select.
Read article →
Not sure which DPI or color mode to pick? These scan settings keep text sharp and PDF files small, for contracts, receipts, books and photos.
Read article →Es gratis, privado y lleva solo unos segundos. Tus archivos nunca salen de tu dispositivo.