Libros antiguos

Biblioteca Digital Hispánica: cómo leer sus libros antiguos en tu lector de ebooks

La Biblioteca Digital Hispánica (BDH) de la Biblioteca Nacional de España ofrece sus libros digitalizados sobre todo como PDF de páginas escaneadas. En un lector de ebooks esas páginas se ven fijas y diminutas. Para leerlos con comodidad hay que convertir el PDF a EPUB con un OCR que reconstruya párrafos y capítulos; la BNE permite usar libremente las obras de dominio público siempre que se cite la procedencia.

Qué es la Biblioteca Digital Hispánica

La BDH es la biblioteca digital de la Biblioteca Nacional de España. Reúne libros impresos, manuscritos, prensa, grabados y mapas digitalizados. Según las preguntas frecuentes de la propia BNE, casi todo lo que está en la BDH es de dominio público.

  • Formato: los documentos se consultan en un visor web y muchos se pueden descargar en PDF. La BNE indica que para los PDF hace falta Adobe Acrobat Reader.
  • Texto: parte de los documentos ha pasado por reconocimiento óptico de caracteres (OCR) y se puede buscar dentro del texto. No todos: un PDF puede ser solo imágenes.
  • Uso: las obras de dominio público se pueden descargar libremente para uso privado, y el uso público, incluso comercial, también es gratuito y sin autorización previa. Solo hay que citar la procedencia.

Parte del catálogo se muestra ahora en la plataforma BNE Digital. Si un enlace antiguo de la BDH te lleva allí, busca el libro por título y usa la opción de descarga del visor.

Por qué un PDF de la BDH se lee mal en un ereader

Un PDF escaneado guarda cada página como una fotografía. En una pantalla de 6 pulgadas una página de un libro del siglo XIX queda reducida a letra minúscula, y ampliar solo obliga a desplazarse de un lado a otro. El tamaño de letra, el diccionario y la búsqueda no funcionan porque no hay texto, solo imagen.

Los conversores habituales no lo solucionan. Calibre, por ejemplo, no tiene OCR: en nuestro escaneo de prueba de 214 páginas recuperó 18 palabras del libro. Y el OCR sin más deja los números de página y los encabezados en medio de las frases.

El mismo escaneo de 214 páginas, de cuatro maneras
MétodoPalabras recuperadasTexto limpioEntradas del índiceEPUBCheckTamaño del archivo
EPUB de Internet Archive96,8%88,5%032 errores12.1 MB
Calibre sobre el escaneo0%–0válido44.0 MB
OCRmyPDF y luego Calibre0%–0válido43.9 MB
upub99,2%99,2%39válido167 KB

Medido el 2026-10-02 frente al texto corregido de Project Gutenberg #11 (26.681 palabras). Palabras recuperadas: la parte de ese texto que aparece en el EPUB, en orden. Texto limpio: la parte de las palabras del EPUB que pertenecen al libro y no a encabezados, números de página o ruido de OCR.

La tabla compara el mismo libro escaneado convertido de cuatro maneras. El EPUB de upub coincidió en un 99,2 % con el texto revisado y tiene 39 entradas de índice; el EPUB automático de Internet Archive no tiene índice y falla en EPUBCheck.

De la BDH a tu lector, paso a paso

  1. Busca la obra en la Biblioteca Digital Hispánica o en BNE Digital y ábrela en el visor.
  2. Descarga el documento en PDF. Si solo puedes descargar imágenes sueltas, guárdalas todas en una carpeta.
  3. Comprueba si el PDF tiene texto: intenta seleccionar una frase. Si se marca toda la página, es solo imagen.
  4. Sube el PDF o la carpeta de imágenes a upub y elige tu lector, por ejemplo Kindle Paperwhite, Kobo Clara BW o tolino shine 5.
  5. upub lee cada página, quita números de página y encabezados, une los párrafos partidos y crea el índice. Descarga el EPUB y pásalo al lector.
  6. Si vas a compartir el libro, cita la procedencia: la BNE lo pide para cualquier uso público.

Ortografía antigua y tipografía

upub transcribe el texto tal como está impreso: no moderniza la ortografía. Si el libro escribe "muger" o "á" con tilde, así quedará en el EPUB. Es la opción correcta para una edición histórica, pero conviene saberlo antes de leer.

Los libros anteriores a 1800 suelen usar la s larga (ſ), que se parece a una f, y abreviaturas tipográficas. Son más difíciles de leer para cualquier OCR, así que revisa algunas páginas del resultado. Los libros del siglo XIX en tipografía moderna dan resultados mucho más limpios.

Otras fuentes de libros antiguos en español

FuenteQué ofrece¿Hace falta convertir?
Proyecto GutenbergTexto revisado, también en EPUBNo, si tu libro está allí
Biblioteca Digital Hispánica / BNE DigitalPDF escaneado, a veces con OCRSí
Internet ArchivePDF escaneado y un EPUB automáticoSí, el EPUB automático suele estar desordenado
Google BooksPDF o EPUB de libros de dominio públicoNormalmente sí

Si tu lector es un Kindle, nuestra guía para leer PDF escaneados en Kindle explica cómo enviar el EPUB con Send to Kindle.

Preguntas

¿Se pueden descargar los libros de la Biblioteca Digital Hispánica?
Sí. Las obras de dominio público se pueden descargar libremente, normalmente en PDF. La BNE permite también su uso público, incluso comercial, citando la procedencia.
¿En qué formato descarga la BDH los libros?
Sobre todo en PDF, con las páginas escaneadas. Parte de los documentos tiene OCR y se puede buscar en el texto, pero no todos.
¿Cómo convierto un PDF de la BDH a EPUB?
Si el PDF es solo imagen, necesitas un OCR que también reconstruya párrafos y capítulos. upub lo hace y genera un EPUB adaptado a tu lector.
¿Se moderniza la ortografía antigua?
No. El texto se transcribe tal como está impreso.

Pruébalo con tu propio escaneo

Sube un PDF escaneado o una carpeta de fotos de páginas. Recibes un EPUB con texto real, capítulos y tabla de contenidos.

Fuentes

  1. BNE: Preguntas frecuentes de la Biblioteca Digital Hispánica (PDF)
  2. Biblioteca Digital Hispánica
  3. BNE Digital
  4. Escaneo de prueba: Alice's Adventures in Wonderland, Macmillan 1872
  5. Manual de Calibre: conversión de PDF