Se lee cada página
No solo el texto, también la maquetación: dónde está el titular, qué pie corresponde a qué foto, dónde empieza un artículo nuevo y dónde continúa.
Tú entregas el PDF de una edición. La herramienta lee cada página, reconoce titulares, entradillas, cuerpo de texto, pies de foto, recuadros e imágenes, y los convierte en artículos sueltos. Listos para publicar, archivar o pasar a tu propio sistema.
La mayoría de las editoriales ya tiene su edición perfectamente maquetada en un PDF, y luego debe rehacerla a mano para la web. Volver a teclear, copiar y pegar, extraer imágenes, buscar los pies de foto. En cada número.
Un PDF no sabe qué es un titular ni qué es cuerpo de texto. Solo sabe dónde está cada letra. Por eso una extracción de texto sencilla produce una masa que nadie puede aprovechar.
No solo el texto, también la maquetación: dónde está el titular, qué pie corresponde a qué foto, dónde empieza un artículo nuevo y dónde continúa.
Titular, antetítulo, sección, entradilla, cuerpo, ladillo, destacado, pie de foto, firma, tabla, publicidad. Así tu sistema sabe qué hacer con cada fragmento.
Las imágenes se extraen del PDF tal como están, con su pie asociado. No son capturas de pantalla de páginas.
Cada publicación tiene su maquetación. Tras el primer número la herramienta fija las reglas de tu cabecera y las aplica a todo lo que venga después.
Publica la edición como número digital: los lectores hojean las páginas y abren los artículos en formato legible, en móvil y en pantalla grande.
Exporta cada edición como ZIP con los artículos en HTML y los datos en JSON, imágenes incluidas, para tu propio CMS.
Editoriales de publicaciones técnicas, revistas de asociaciones, revistas de gran público y periódicos locales que quieren ofrecer también en línea su edición impresa, sin convertirlo en una tarea de redacción.
También para grupos editoriales con varias cabeceras: cada publicación mantiene sus reglas y el proceso sigue siendo el mismo.