PDA

Ver la versión completa : Conversor Grammata: símbolos y almohadillas



Lana
27/02/2009, 10:20
Hola,

Tengo el Papyre desde hace algo más de un mes y aún no he conseguido hacer ninguna conversión que me salga bien. He paseado por los tutoriales, me he descargado varios programas: File Convertor; Book designer (pero llega un momento en que lo que me indica mi pantalla es diferente a lo que indica el tutorial que debería salir), ahí me pierdo y soy incapaz de continuar.
He acabado desististiendo y, hasta ahora, viendo que perdía horas ante el ordenador sin conseguir leer en el Papyre ningún archivo de los que he convertido, los he leído en pdf tal cual me los descargaba con el zoom al máximo para no quedarme ciega, pero ha llegado un punto en el que me he hartado de hacerlo así, y he vuelto a intentarlo, esta vez con el Conversor de Grammata, pero no me ha dado resultado con ninguno de los 4 formatos disponibles. ¿Qué hago mal?

1º-Primero paso el archivo PDF por el PDF Unlocker

2º-Lo paso a los 4 formatos

3º-De esos 4 archivos, en principio el ordenador sólo me reconocía el PDF, así que después de indagar, me descargué el FBReader, y parecía que ya reconocía tanto los PFf como los FB2.

4º- Una vez pasados los 4 archivos al Papyre, no hay manera, todo son almohadillas, números y otros símbolos.

Estoy empezando a pensar que hay que ser todo un experto en ordenadores para poder usar un e-reader :((

PD: Se me olvidó decir que lo de los símbolos se ve ya en el ordenador, nada más usar el conversor, no hace falta pasarlo al Papyre para que se estropee.

Palantir
27/02/2009, 13:29
Hola Lana, como tu, creo, se poco de esto. Yo empecé convirtiendo cualquier documento a .doc (legibles a través de Word o writter de Open Office) y después guardándolo como .rtf. Haciendo eso solo el papyre ya te los visualiza bastante bien, solo que divide mal las sílabas al final de línea, aunque no es un problema grave, y no admite gráficos, es solo texto plano. Con ese sistema he leído ya bastantes.
Ahora con el mobipocket reader los convierto a ese formato y mesalen unos libros muy bién ajustados de tipo de letra, márgenes, sin separación de sílabas y con inclusión de gráficos e imágenes, así que de momento bién.
Lo del rtf es muy sencillo, desde word le das a guardar como y debajo del título del archivo hay una lista desplegable, buscas .rtf y ya.
Venga

Pacs
28/02/2009, 22:50
hola

esto suele pasar con los pdf's que vienen protegidos. el adobe reader y demas los abre bien, pero no los conversores, ni copy-paste en word, etc. yo todavia no he encontrado una solucion a esto (ni con el acrobat, aunque tampoco lo he investigado mucho). supongo que con un pdf corriente te funcionara bien.

suerte, y paciencia, que todos hemos pasado por este proceso de aprendizaje. pero una vez pillado el tranquillo se disfruta muchisimo.

lana, si te apetece mandame un pdf de los que te dan problemas, lo intento convertir y de paso investigamos un poco, que me interesa resolver este tema. (tengo unos cuantos pdf's de estos)

saludos

Lana
03/03/2009, 16:54
Gracias por las respuestas.

Palantir, cuando te refieres a convertir el PDF a .doc. ¿puedes decirme con qué programa y así pruebo a ver?

Pacs, te enviaré uno de esos PDF, que son todos los que trato de convertir,puesto que todos los libros de mi biblioteca están en ese formato.
Estoy un poco-bastante decepcionada, quizás si hubiera sabido que era tan problemático usarlo....

pacotaco
03/03/2009, 17:25
dime el nombre del libro ese que te trae por la calle de la amargura.....a ver si podemos hacer algo

Lana
03/03/2009, 21:49
Jajaja, gracias Pacotaco. Todos mis libros están en ese formato así que me pasa con todos los que tengo. Tengo que aprender a modificarlos como sea.

Si quieres te envío un link por privado (por si acaso aquí no se puede poner) y si puedes "convertirlo" y me explicas los pasos para hacerlo te pongo en un pedestal, y seguro que Pacs también, que tiene el mismo problema con algunos de los suyos.

pacotaco
04/03/2009, 00:05
pon el link no creo que haya problemas....

Pacs
04/03/2009, 02:59
bueno, parece que el problema son los pdfs que tienen fuentes incrustadas, nada que ver con la proteccion.

a primera vista, la unica solucion que se me ocurre es exportar desde adobe acrobat a archivos de imagen (jpg o tiff, etc...), y pasar estos despues por un OCR. asi al menos funciona y ya podemos tenerlo en texto.

aunque no estoy completamente seguro, creo que se podria editar o exportar el texto directamente si pudieramos disponer de la fuente incrustada original o si la fuente incrustada fuera una de las habituales. el caso es que los pdfs de este tipo que me he encontrado llevan incrustadas fuentes postcript de las "no habituales". suponiendo que el que crea de esta manera un archivo lo hace para protegerlo, o bien va ser dificil o imposible conseguir la susodicha fuente, o va ser mas tedioso que el metodo del OCR.

si a alguien se le ocurre algo mas...

salut!

Pacs
04/03/2009, 13:26
acabo de convertir con exito dos pdf's con este problema de las fuentes incrustadas. os cuento el metodo por si a alguno le interesa:

1. abrimos el pdf y directamente exportamos todas las paginas en jpg. he usado el adobe acrobat y desconozco otro programa que haga lo mismo, aunque seguro que lo hay.

2. abrimos todos esos jpg en un programa de OCR. he utilizado el ABBYY que encontramos en la seccion descargas y que ha funcionado estupendamente. procesamos las paginas y guardamos en rtf. voila!!!

En realidad es muy sencillo, lo unico que cada paso lleva unos minutos dejando que el pc trabaje.

saludos

Lana
04/03/2009, 16:37
¡Gracias Pacs! Voy a intentar seguir los pasos que has comentado, aunque no sé ni lo qué es un OCR ni como se exportan las páginas a jpg. Ya googlearé a ver cómo, porque lo que yo quiero es aprender cómo se hace.

zote
04/03/2009, 17:10
Habéis probado imprimir en una impresora virtual y luego recuperar el texto del archivo impreso?

no recuerdo bien, pero en algunos lectores de pdf se pueden configurar fuentes, así como en los archivos de salida de por ejemplo el pdf creator... no me toméis demasiado en serio porque hablo de memoria, pero creo que podría funcionar...

TALUÊ

Pacs
04/03/2009, 17:46
hola zote


Habéis probado imprimir en una impresora virtual y luego recuperar el texto del archivo impreso?

es que mas o menos ese es el metodo propuesto.

el problema es que estos archivos se comportan como si el texto no estuviera en ASCII, y por eso salen simbolos extraños al pasarlo a word, a book designer, etc...yo no le veo otra solucion que pasarlo a un archivo de imagen (impresora virtual) y un despues un OCR (recuperar el texto).

incluso el propio acrobat pro te avisa de que pierdes el texto al desincrustar la fuente si no cuentas en tu sistema con la fuente original.

si hay otra solucion mas agradecida, bienvenida sea.

saludos

zote
04/03/2009, 23:32
hola pacs:

la diferencia es que la impresora virtual no te da una mera imagen, sino un texto integrado en un pdf (puedes comprobarlo si el pdf que obtienes puede hacer reflow con el acrobat reader)

si ese es el caso, quizá se pueda extraer el texto mediante cualquiera de las utilidades que solemos emplear o simplemente con un copy/paste... si hay suerte

recordad que hay que mirar en las opciones de guardado de la impresora virtual para que no nos vuelva a incrustar las fuentes,

a ver si de esta manera podemos evitarnos el paso del ocr, que por muy bien que funcione, siempre introduce algún error.

TALUË

Pacs
06/03/2009, 18:11
joer, yo no si se es que estan rasterizados, o son vectoriales, o lo de las fuentes incrustadas, o si es que son pura imagen.....el caso es que estos pdfs no llevan texto. yo hasta aqui he llegado con este tema.

y al final no hacia falta tanta historia, el fine reader ya te lo hace todo en un solo paso.

salut!