🌐 Español

pdftoepub.co

No envuelve tu PDF como imágenes de páginas: reconstruye el texto desde cero y produce un EPUB 3 verdaderamente adaptable a cualquier pantalla.

Publicidad
Elige tu archivo PDF toca o arrastra y suelta — hasta 100 MB

Al pulsar Convertir confirmas que tienes derecho a procesar el archivo que subes.

Publicidad

¿Por qué es difícil convertir un PDF escaneado a EPUB?

Cuando se escanea un documento, el PDF contiene en realidad imágenes de las páginas. El texto lo genera después el programa de OCR y se coloca sobre la imagen como una capa invisible. Esa capa no dice dónde empieza un párrafo, qué línea es un título ni qué palabra va en cursiva: solo guarda líneas independientes de las que se conoce su posición en la página.

Los conversores corrientes toman esas líneas tal cual. El resultado es un archivo donde cada línea es un párrafo aparte, los números de página aparecen en mitad de las frases y las palabras quedan partidas en dos. Esta herramienta, en cambio, reconstruye el texto desde cero.

¿Qué ocurre durante la conversión?

ProblemaQué se hace
Marcas de agua y encabezadosSe eliminan las líneas cortas que se repiten en la mayoría de las páginas, el texto de los márgenes y las fuentes distintas a la del cuerpo
Palabras partidas al final de líneaSe quitan los guiones de partición y se unen las mitades
Límites de párrafoSe mide la sangría para saber dónde empieza un párrafo nuevo; un párrafo que cruza el salto de página no se rompe
Errores de letras del OCRSe corrigen tomando como prueba el propio vocabulario del documento
SeccionesSe detectan por el espacio que se deja al abrir sección; el índice se construye automáticamente
Portada y datosLa imagen de portada y el título/autor se extraen del PDF

¿Cómo se mantiene segura la corrección del OCR?

Los programas de escaneo confunden letras: la w se lee a menudo como vv. Pero corregir a ciegas estropea palabras reales: la palabra turca “kuvvet”, por ejemplo, contiene realmente vv. Esta herramienta no corrige con un diccionario externo, sino con el vocabulario del propio documento: si la grafía correcta ya aparece con frecuencia en ese mismo documento, corrige; si no, deja la palabra intacta. Cada cambio se enumera en la pantalla de resultados y puedes desactivar la corrección por completo.

Preguntas frecuentes

¿Qué diferencia hay entre un PDF escaneado y uno normal?

En un documento escaneado cada página es una imagen; el texto lo produce el OCR y se coloca de forma invisible sobre ella. Esa capa no contiene ninguna información estructural: ni párrafos, ni títulos, ni cursivas. Esta herramienta vuelve a deducir la estructura a partir de la disposición de la página.

¿Se guardan mis archivos?

El PDF subido y el EPUB generado se guardan en almacenamiento temporal y se borran automáticamente en 24 horas. Los archivos no se comparten con terceros.

¿Hasta qué tamaño de archivo se admite?

Archivos PDF de hasta 100 MB. Un documento típico de 300 páginas se convierte en unos segundos.

¿Se pueden convertir PDF sin capa de texto?

Sí. Si subes un archivo así, te ofrecemos ejecutar el reconocimiento de texto en esta misma página, en tu propio ordenador: el archivo no se envía a ninguna parte para ello. Los datos del idioma se descargan la primera vez y los documentos largos pueden tardar unos minutos.

¿Quién es responsable de los archivos que subo?

La responsabilidad de los archivos subidos y de la conversión recae por completo en el usuario. Sube únicamente archivos que tengas derecho a procesar.

Publicidad
Publicidad
Publicidad