Ver la versión completa : Biblioteca Spanish coolreader
Efectivamente leobueno, esa fue la línea que seguí. Al final la biblioteca *.pdb, tiene las reglas del silabeo en los distintos idiomas.
El problema estriba en que es una biblioteca que le faltan muchas reglas del español. Verdaderamente sólo Word y Openoffice tienen una buena implementación del idioma español.
Estuve viendo la posibilidad de meterle mano, y ahí fue donde no pude seguir.
Una solución "no muy buena" es crear en el directorio raiz de la memoria interna del Papyre el directorio crengine y poner el archivo fb2.css y el archivo Russian_EnUS_hyphen_(Alan).pdb cambiando previamente el nombre del archivo Spanish_hyphen_(Alan).pdb
Mejora el silabeo pero no lo soluciona.
Saludos.
Juan
He estado analizando el problema a fondo analizando el código fuente del crengine y haciendo cambios en el contenido del archivo Spanish_hyphen_(Alan).pdb y he obtenido algunos resultados. Otra opción sería crear un algoritmo eficiente de silabeo en español y cuando se seleccione español, en lugar de usar el método de Alan, que parece efectivo en otros idiomas pero en español no sirve, ejecutara dicho algoritmo.
La estructura del archivo ya la tengo más o menos clara. He instalado la última versión del coolreader para windows que me permite hacer cambios rapidos en el fichero de Alan y ver los resultados. El archivo es una base de datos con indices según la primera letra de la sílaba y la segunda. El problema aparece con las silabas de 3 letras. Empece el estudio con la palabra "matrimonio", que la cortaba en "matrimon-io". La sílaba "nio":
el bloque de la "n" comienza en la posición 28f8h (hexadecimal). Luego, según la segunda letra de la sílaba a analizar tenemos un indice a donde tenemos que saltar en 29d2h. Nos dice que sería un salto de 3ch (60 posiciones en decimal) desde donde comienzan las sílabas. El bloque de "ni" contiene "ni100 nia1000 nie1000 nio1000 niu100". Una vez buscamos en ese bloque y la encontramos, los números representan si se puede cortar o no delante o detras de esa letra. Observando el resto del fichero vi que en algunos grupos de 3 letras aparece un 2. Cambié el nio1000 por 1200 y dejó de cortar por donde no debía.
Os propongo que publiquéis palabras mal cortadas indicando donde está el fallo (ejemplo: "matrimon-io") y así ir corrigiendo el fichero.
Pregúntome yo: ¿esta no es la misma libreria que conocemos, que vienen ya usando de siempre los rusos, y que también está integrada y funcionando en el firmware de Lbook? ¿al seleccionar el silabeo en español (no el algoritmico), no estamos ya seleccionando usar las reglas españolas (o, Lbook, sólo incluye las rusas e inglesas, lo dudo, porque en la lista de idiomas aparecen específicamente los soportados)? es decir, no la tenemos ya vista y en funcionamiento de siempre al instalar el Lbook, ya hemos comentado en repetidas ocasiones que, funcionar, funcionaba, pero todavía fallaba mucho.
Por otra parte, echando un vistazo al Google, veo que esta biblioteca y su autor, el tal "Alan" como se menciona siempre, viene ya de lejos y puede estarse usando en muchos programas y lectores, como el allReader, PocketPC, PDAs, y otros. Y esto me lleva a pensar también si no se pudiera buscar también alguna alternativa, biblioteca, algoritmo, o algo similar en el mundo de las PDAs, Windows CE, y similares, que para estas cosas y en muchas otras cuentan también con lectores y programas muy probados, evolucionados y user-friendly.
El firmware de Lbook incluye todos los ficheros de Alan para los idiomas que llegó a crearlos. Otros firmwares solo abren el Russian_EnUS_hyphen_(Alan).pdb aunque permiten poner otro siempre que se llame igual y lo coloques en la famosa carpeta crengine. El de español es muy pobre además de tener fallos. Y esos fallos son los que pretendo corregir. Además creo que estudiando un poco más el fichero incluso podriamos hacerlo crecer, corrigiendo otros tipos de fallos que comete.
NOTA: El algoritmo de Alan es único. Los ficheros contienen patrones de silabas que indican por donde se debe o no cortar. Como hay muy pocas silabas en el fichero de español, acaba cortando por donde le parece.
Ergo... a lo que iba, es lo que usabamos y la libreria que aparecía por todos los sitios en the-ebook.org, el mismo sitio de siempre fuente primordial de nuestras esperanzas e información.
Con destriparla, cambiarla, mejorarla, etc. igualmente, y además, y aún mejor, y más funcional, al Lbook, y más contentos ;)
leobueno
14/10/2009, 16:28
Una idea.... por si sirve de algo.
¿Por que no coger un archivo de guionado "pata negra" como son los de LaTex (hyph-es.tex) y convertirlo al formato PDB de Alan?
http://tug.ctan.org/cgi-bin/ctanPackageInformation.py?id=hyph-utf8
El código de carga de los PDB está disponible y si el comentario inicial del hypman.cpp es cierto, es lo que hizo Alan para generar sus archivos (Pero se ve que no escogió el archivo adecuado).
/** file hyphman.cpp
rief AlReader hyphenation manager
(c) Alan, adapted TeX hyphenation dictionaries code: http://alreader.kms.ru/
(c) Mark Lipsman -- hyphenation algorithm, modified my Mike & SeNS
Adapted for CREngine by Vadim Lopatin
This source code is distributed under the terms of
GNU General Public License.
See LICENSE file for details.
*/
Es otra posibilidad. A ver si damos con qué es lo que aprovecha de los ficheros tex y como se interpreta el contenido de dichos ficheros. El fichero a generar lo tengo más o menos claro de la de vueltas que le he dado ya. Aquí (http://www.fi.muni.cz/~xantos/patlib/thesis/thesis-p.pdf), en este fichero pdf, explican en inglés como se generan los patrones de los ficheros Tex. A ver que saco en claro.
Una idea.... por si sirve de algo.
¿Por que no coger un archivo de guionado "pata negra" como son los de LaTex (hyph-es.tex) y convertirlo al formato PDB de Alan?
http://tug.ctan.org/cgi-bin/ctanPackageInformation.py?id=hyph-utf8
Joperretas! Has dado en el clavo, y también forma, a la idea abstracta que estaba dando vueltas dentro de mi hiperespacio neuronal, sobre la posibilidad de enredar con las librerias encargadas del dichoso tema para el OpenOffice o el Linux.
¡Sería qualità totale! :-)
Pues la cosa sigue tomando forma. Hay una relación directa entre los 2 ficheros. En el de Tex, si un patrón empieza por ".", en el de alan es un espacio en blanco. Si termina en un punto, idem de lo mismo.El significado es que la palabra empieza o termina por ese patrón, respectivamente. Luego, los números tambien tienen su relación directa. Un patrón en text tal que ".hu4meo", sería en Alan " humeo004000".
Sigo investigando ...
Bueno, gracias a python y a su facilidad de manejo de listas y cadenas ya tengo la lista preparada para pasar al formato binario especifico de Alan. La he generado a partir del fichero de patrones de Latex como aconsejaban por aquí. Se trata de un total de 2963 patrones.
Efectivamente leobueno, esa fue la línea que seguí. Al final la biblioteca *.pdb, tiene las reglas del silabeo en los distintos idiomas.
El problema estriba en que es una biblioteca que le faltan muchas reglas del español. Verdaderamente sólo Word y Openoffice tienen una buena implementación del idioma español.
La siguiente vez que me meta la partición en sílabas el Word, te la mando antes de corregirla y hablamos sobre la "buena" implementación.
Bueno, gracias a python y a su facilidad de manejo de listas y cadenas ya tengo la lista preparada para pasar al formato binario especifico de Alan. La he generado a partir del fichero de patrones de Latex como aconsejaban por aquí. Se trata de un total de 2963 patrones.
Quiere decir eso que ya está la solución en el horizonte?
Bueno, gracias a python y a su facilidad de manejo de listas y cadenas ya tengo la lista preparada para pasar al formato binario especifico de Alan. La he generado a partir del fichero de patrones de Latex como aconsejaban por aquí. Se trata de un total de 2963 patrones.
Muy buena noticia y muchas gracias por tu tiempo, trabajo e interés.
¿El formato binario se puede identificar y generar fácil? ¿Eran expresiones o patrones particulares del programa, en cadenas especiales, en expresiones regulares, en algún lenguaje o formato conocido, o algo así?
Confieso que no he mirado ninguno de los dos ficheros al final :')
Se te veía muy puesto y lanzado de todas formas en el tema :)
'tamos ansiosos!
Bueno, ahí va la primera prueba (http://www.megaupload.com/?d=TXYLKJP4). El fichero no está acabado, aunque lo que falta no se usa en las funciones de hypman.cpp. He tenido que retocar algunos patrones para que funcionasen por ser demasiado cortos, ya que el algoritmo esta basado en el de TeX pero no es 100% igual. Si encontráis palabras que no son bien cortadas comunicadlo en este post, a ver si podemos agregar los patrones que puedan faltar. Si todo va bien podríamos remitirselo a Buggins para que lo reemplace en la version de Lbook.
agostoesquimal
16/10/2009, 13:58
Hola a todos.
Muchisimas gracias markmtc,por el esfuerzo,la dedicacion y compartirlo con todos nosotros.
El archivo tengo que ponerlo en la carpeta crengine y luego elegir la hyphenation en ruso?perdona mi ignorancia.
Muchisimas gracias.
saludos
El firmware de Lbook no se si permite colocar el fichero en la tarjeta o la memoria interna, pero el de grammata por ejemplo creo que si. Tienes que hacer eso mismo que has dicho pero no tienes que elegir nada, ya que el único que te deja elegir entre distintos ficheros de Alan es el de Lbook. Para los que nos gusta el de Lbook tendremos que mandárselo a buggins para que lo incluya en la próxima revisión.
Bertrand
16/10/2009, 14:49
Enhorabuena por tu trabajo, lo acabo de instalar (lo he introducido como tal en la carpeta crengine de la tarjeta) y en 34 páginas sólo he observado los siguientes fallos:
fatali-smo, eje-rcicios y conve-rsación.
Ha mejorado bastante y sólo te queda pulirlo para que sea perfecto. He notado que intenta separar menos las palabras, pero no dejando demasiada distancia entre ellas.
Utilizo un firmware semejante al de grammata.
Gracias.
Mola bastante, mark, gracias por tus conocimientos. No me ha quedado claro si en el Lbook es posible o no incluirlo.
windrider
16/10/2009, 15:50
Tio, eres grande
^:)^ ^:)^ ^:)^ ^:)^
johansolo
16/10/2009, 16:10
Genial.
He empezado a probarlo en el coolreader para pc (para no tener que estar toqueteando mis fb2.css) y se ve mucho mejor que con el anterior fichero.
Por ahora me he encontrado con estos fallos:
paraleli-smos
cali-stenia
imp-lora
Y con una curiosidad con aparentemente.
Es capaz de separar la última sílaba sin problemas.
http://img225.imageshack.us/img225/7627/aparentemente2.jpg (http://img225.imageshack.us/i/aparentemente2.jpg/)
Pero he aumentado el tamañó de la letra para que hiciera separaciones diferentes y aquí se nota que no es capaz de partir aparentemente en aparente-mente.
Tendría que ver más palabras con el sufijo -mente para estar seguro, pero supongo que se repetirá.
http://img148.imageshack.us/img148/9481/aparentemente1.jpg (http://img148.imageshack.us/i/aparentemente1.jpg/)
Lo que he hecho hasta ahora es crear un programa en python que le pasas el fichero que hypen-es.tex y lo convierte al formato pdb. El fichero que estoy usando lo he obtenido de http://www.tug.org/ y parecía actualizado. Lo cierto es que no se que tal funciona el silabeo en TeX pero el archivo que obtuve parecía reciente.
Otro tema es interpretar lo que hace el programa con estos patrones para ver si podemos ir añadiendo y corrigiendo errores o si no sería mejor generar uno de cero. He observado que el silabeo a mejorado pero como bien comentáis a costa de no dejar algunas palabras separarse, y no entiendo para que.
Según leo aquí (http://www.aq.upm.es/Departamentos/Fisica/agmartin/webpublico/latex/FAQ-CervanTeX/FAQ-CervanTeX-6.html#ss6.6), es un tema que trae cola y en LaTeX optan por sólo cortar cuando no haya más remedio, y evitando que las palabras resultantes no sean malsonantes. Esto aclara los resultados con la nueva tabla.
De todas formas siempre podemos ir agregando las palabras que encontremos que se cortan mal.
En primer lugar dar las gracias a markmtc.
A ver si puedo rapidito... (zzzz)
A ver, he intentado con el Lbook de todas las formas posibles, pero no ha habido manera, con todas las posibilidades, nombres de archivos cambiados y sin cambiar, almacenamiento externo e interno, trucos, nada... el Lbook, por seleccionar el idioma, parece que va a piñon fijo a por el fichero integrado en el firmware. He rebuscado y mirado hasta en el código fuente de un par de versiones... nada, parece que pilla "Russian_EnUS_hyphen_(Alan).pdb" y los otros archivos .pdb, a piñon fijo, y de los internos, no hay busqueda ni cadenas ni nombres de path delante. También he probado con los últimos de Buggins, pero aquí, aparte de no funcionar tampoco, ya pasan otras cosillas extra y tiene más miga el asunto.
... pero he descubierto algunas cosas my interesantes en esta búsqueda, y curiosas que no sabía del Lbook, mmm....
Bueno! Firmware oficial de Hanlin, ya puestos, pues lo he re-comprobado con el reciente "V3 2.11-20090930". He logrado hacerlo funcionar al final.
Curioso. Hay que meter el fichero, y con el nombre "Russian_EnUS_hyphen_(Alan).pdb" en la carperta /crengine de la SD, y además así, funciona y afecta tanto a los ficheros de la memoria interna, como de la tarjeta SD; idem para las fuentes y las CSS.
Locura, ni un sitio, ni los dos, ni prioridades, si lo metes en la memoria interna, ni funciona, ni afecta a ninguno de los dos sitios!. También he probado con el nombre en español, y nada (lógico, puesto que el firmware base chino, pero por si acaso, puesto que cambié el idioma del interface a español); quizá los de Grammata cuando cambian el nombre y el logo para el suyo, también lo hacen con algunas pequeñas cosillas como la tontería de buscar el "Spanish_hyphen_(Alan).pdb". Bueno, yo lo he logrado hacer funcionar así al final, y con la última .css que puse esto ya pita y se ve muchoooo mejor; es espera de confirmar todo con un poco mñas de calma, o de un nuevo oficial de Lbook, o alguna manera de meterle el fichero, ¡cambiamos de firmware de nuevo!
Ah! Curioso, en el lector, no me separa correctamente la palabra invie-rno, mientras que en el Cool Reader en el PC, no le logrado hacer que me la separe mal (?)
leobueno
17/10/2009, 10:25
markmtc, muchas gracias por todo.
Aquí está la lista de lo que voy encontrando.
fue-rza
abie-rta
izquie-rda
chascapie-rnas
descubie-rto
conse-rvarían
quere-rlo
Como no termina de ir bien, lo que voy a hacer es terminar el programa, pasaroslo y así podemos hacer pruebas mas concretas cada uno. El programa está en python y se le pasa como argumento un fichero con los patrones en texto plano en formato tex y devuelve el fichero de Alan.
En este (http://www.fi.muni.cz/~xantos/patlib/thesis/thesis-p.pdf) pdf que encontré por internét explican en las primeras páginas, aunque en inglés, como funciona el algoritmo de latex. Por lo que he estudiado el hypman.cpp se parece bastante, pero las pequeñas variaciones en el algoritmo son las que hacen que no funcionen bien los patrones.
Lo dicho, en cuanto tenga el programa terminado os lo paso.
vie-rnes
apa-rtaba
instruc-ciones
renquea-ba
siguie-ra
abie-rtas
esfue-rzo
Jotas
Intruc-ciones está bien separado.
Las sílabas son in--truc--cio--nes.
Y renquea-ba y siquie-ra también están bien separadas.
Hmm... Revisa esa gramática...
:')
... y las prisas, gracias por el toque
siquie-ra no sé ni por qué la he puesto
renquea-ba pues tendrás razón, pero no me suena ni acabo de ver bien lo de separar los "aba"
ins--truc--cio--nes
Renqueaba se separa en sílabas:
Ren-que-a-ba.
Por lo que si no estoy equivocado, si aparece al final:
renquea-
ba
Estaría bien, pues la última sílaba completa es ba...
(Creo :> )
Arggh Instrucciones, INS, INS, INS, INS
Lo mal que queda equivocarse cuando uno está corriegiendo (bolla el muro a cabezazos).
Azbarhael
17/10/2009, 16:23
Otra más
fue-
rte
Maldoror
17/10/2009, 16:40
Pues parece que se repite muchísimo partir vocal y r de final de sílaba.
Si sólo se produce este error, es que estáis muy cerca de la solución.
Otro enlace interesante. Aquí explican bastante bien las reglas de silabación. Si no funciona el parcheo del de TeX, podemos construir uno en base a esta (http://elies.rediris.es/elies4/Fon2.htm#6.2. Reglas de silabación.) explicación.
A proposito, al programa le queda menos. :')
He rebuscado y mirado hasta en el código fuente de un par de versiones... nada, parece que pilla "Russian_EnUS_hyphen_(Alan).pdb" y los otros archivos .pdb, a piñon fijo, y de los internos, no hay busqueda ni cadenas ni nombres de path delante.
Sobre esto, a ver, en los antiguos de Lbook, si se podía hacer, y se contemplaba sólo el uso del fichero .pdb conocido ruso, e incluso había que colocarlo (creo que en /crengine, igualmente, o sino algo muy parecido era), pero ya en versiones más modernas se añadió incluir todos y seleccionar por menú, y parece que no hay forma.
Las funciones crean y buscan un path una variable also así como "%snombrefichero.pdb", donde %s lo hacen igual al path principal del ejecutable (ExeDir creo que era, o algo similar). Como me da que no hay forma de enredar o entrar por ssh o algo así para sustituirlo, son ganas, porque al final es todo código abierto.
Volver a usar un Lbook muy antiguo o andar con el código viejo y sus problemas creo que no merece la pena en absoluto.
Ah! Otra cosa, los firmwares de BeBook, creo que incluso los actuales, creo que todavía cuelan con este tema y usan un único "Russian_EnUS_hyphen_(Alan).pdb", que se puede colocar en la carpeta /crengine para probar y sustituirlo. Los basados en el Cool Reader, claro, que hicieron algunos especiales basados en FBReader.
Ah! Otra cosa, los firmwares de BeBook, creo que incluso los actuales, creo que todavía cuelan con este tema y usan un único "Russian_EnUS_hyphen_(Alan).pdb", que se puede colocar en la carpeta /crengine para probar y sustituirlo. Los basados en el Cool Reader, claro, que hicieron algunos especiales basados en FBReader.
Hilo interesante sobre el tema del silabeo en general, aunque esté en el foro de BeBook:
http://mybebook.com/forum/viewtopic.php?f=4&t=930&p=4823
Otra cosa más, evidentemente también probé a colocar y usar otros tipos de idomas y ficheros .pdb de nombres diferentes, pero con el mismo resultado.
Pero, para verificar esto y alguna otra cosilla, y para enredar, resulta que creando un fichero llamado:
cr3-fb2.ini
en /crengine, en la tarjeta, o en el memoria interna, el firm. de Lbook empieza a crear y guardar la configuración allí, en lugar de la memoria (no la interna de libros, vamos, la de uso del sistema), y con crear el fichero nada más, sin que esté vacio (con uno o dos espacios vale), se crean y comprueban todas las opciones configuradas, incluyendo una linea:
crengine.hyphenation.directory = Russian_EnUS_hyphen_ (Alan).pdb
... que te hace comprobar cual es el fichero, y su nombre, que efectivamente busca y usa el firmware.
Con borrarlo, se vuelve a guardar la config. en memoria (si habéis cambiado valores, tendréis que volver a configuar las opciones).
EDIT: ah!, no, no coló cambiar ese nombre, o colocar delante directamente un nombre de directorio del sistema, un root, un home, un var, un sd o algo así, no lo busca fuera.
Otro enlace interesante. Aquí explican bastante bien las reglas de silabación. Si no funciona el parcheo del de TeX, podemos construir uno en base a esta (http://elies.rediris.es/elies4/Fon2.htm#6.2. Reglas de silabación.) explicación.
A proposito, al programa le queda menos. :')
Oye, (bueno, oigan, todos), he estado un rato buscando algunas cosillas sobre el tema este de la gramática, el silabeo, su aplicación a libros y demás.
Por lo visto, resulta que, además de las reglas gramaticales y el silabeo formal y totalmente correcto, en los libros se aplican ciertan reglas, que entiendo no estan muy claras ni escritas, para dividir o no dividir cierto tipo de palabras o de silabas atendiendo al formato y a que puede resultar extraña su lectura.
Vamos, que el tema realmente tiene miga, que vamos a tener que ser flexibles (además de a la fuerza), con los resultados conseguidos y qué se puede ver o conseguir, y que también esto puede explicar en parte lo que hace el algoritmo ese y las reglas y decisiones de no dividir, aunque se pueda, muchas palabras, y tampoco algunas palabras, y compensar con el kerning (que en los lectores ni se hace tan bien, ni se ve tan bien, mejor dicho, se nota más, pues simplemente se añaden espacios).
fest-ival
sem-ana
rech-inante
demas-iado
Bueno, el programa está acabado. Aquí (http://www.megaupload.com/?d=18G9OMDG) lo tenéis. El funcionamienton es simple. Tenéis que tener instalado python (http://www.python.org/download/). luego, en una ventana de CMD (en caso de windows) ejecutáis:
tex2pdb.py c.txt
donde c.txt es el fichero con los patrones en latex. Si mirais el que lleva el paquete rar podéis añadirle patrones.
Os explico brevemente como funciona el silabeo, en latex por lo menos:
Supongamos la palabra "silabeo"
el programa busca todos los patrones que se encuentren dentro de nuestro fichero y supongamos que encuentra los siguientes
.s2i1
1b2e
1l2a
e3o
Los números pares indican por donde no debe cortarse y los impares por donde sí.
.s i l a b e o.
.s2i1
1l2a
1b2e2
e3o
si-la-be-o
por columnas nos quedamos con los valores superiores, y el resultado se interpreta de forma que si el numero es impar se sustituye por un guión. El problema es cuando se solapan un valor par y un impar. En ese caso nos quedamos con el valor mayor y es por eso que los patrones tienen que estar muy bien seleccionados y valorados.
Las palabras terminadas en "-ismo" e "-ismos" las solucioné agregando los patrones:
1i2s1mo.
1i2s1mos.
Sin embargo las terminadas en mente lo modifiqué a 1m2e2n1t2e. y no hay forma de que corte por mente.
Otro tema es que en el fichero original de latex aparecían patrones de una sola letra para el español. El fichero de Alan está organizado de una forma muy peculiar debido a que su primera utilidad fue en las agendas Palm. Estas agendas no tenian un sistema de archivos como el que conocemos, sino que los archivos estaban en memoria y se procuraba organizar los datos para acceder a ellos de forma eficiente sin cargarlos en otra zona de la memoria. Sin embargo, crengine lo cargaen memoria y lo reorganizamos según sus necesidades, pero ha heredado el problema de que los patrones tienen que tener al menos 2 letras. Para solucionarlo tenía 2 opciones, o no contar los patrones de una letra o reconvinarlos con todas las vocales posibles (acentuadas y sin acentuar). El algoritmo actual las reconvina. Por ejemplo teníamos el patrón 1b y yo creo el 1b2a 1b2e ... así con todas las vocales.
Una última cosita. Cuidado con el formato del fichero donde están los patrones. Debe de ser ascii puro(en algunos editores formato MS-DOS, ANSI, etc). Para no liaros os recomiendo editar el c.txt que va adjunto en el rar que ya está en ese formato.
Bueno, a ver que sacamos en claro.
¿Se puede instalar en el papyre con el último firnware de grammata? Si es así, ¿Cómo se hace?.
La verdad es que tengo muy pocos conocimientos de informática y no tengo ni idea de cómo se puede hacer.
Si alguien pudiera explicar paso a paso como instalarlo, sería de agradecer ;)
Un saludo
Saludos y gracias por el trabajo que os tomáis con la programación.
Como yo no sé nada de programación, pregunto:
¿Qué ocurre cuando se usa ese código en CMD? ¿Qué resultado produce?
¿Qué tengo que meter en el Papyre? ¿Y dónde?
Si sois tan amables, pues estupendo; porque yo también quiero que me parta bien las sílabas.
Gracias de antemano.
Joserri
Bueno, el programa está acabado. Aquí (http://www.megaupload.com/?d=18G9OMDG) lo tenéis. Tenéis que tener instalado python
Gracias. Ya lo he bajado cotilleado un poco los fuentes (tio, no va en Python 3) y un par de resultados. La cosa está más o menos clara y sencilla (claro, una vez que alguien lo estudia y explica, gracias).
De momento, para pruebas en el ordenador, hay que usar mejor el CR 3.0.16 de siempre y olvidarse del .21, aunque las cabeceras sean diferentes para cada idioma. El .21 da unos problemas y hace unas cosas raras que no veas. Y luego, está el paso al dichoso lector con un fw 'al dente' de todo, fichero y usuario.
Bueno, la tabla y el código son fáciles. A ver si voy mirando y probando.
Pero me voy lo voy a tomar, esto y todo en general, con muchaaaa más calma, que desde hace un tiempo hay para todos los temas unos rollos y ambiente muy malo en el foro.
Este es el fichero de patrones del FBReader.
Ya sabemos de dónde ha salido. Se puede abrir, es un XML. Evidentemente, el problema del Cool Reader es una mezcla del algoritmo utilizado y el aprovechamiento de los ficheros y formato .pdb existente.
es.pattern (http://www.easy-share.com/1908181884/es.pattern)
Spanish hyphenations description for FBReader (original was taken from the teTeX distribution)
From the original /usr/share/texmf-texlive/tex/generic/hyphen/sphyphen.tex file:
% (c) Javier Bezos 1993 1997.
% (c) Javier Bezos and CervanTeX 2001-2006
% Some parts, (c) by Francesc Carmona
% Licence: LPPL
-->
Está con todos en "hyphenationPatterns.zip" , /FBReader/share/zlibrary, además tiene un "es_UTF-8" en "languagePatterns.zip" con 1646 palabras, prefijos, y signos especiales castellano extra.
Creo que tienen razón, tanto tiene pinta como tiene los datos debidos y apropiados suficientes para español, y montones de idiomas más.
fest-ival
sem-ana
rech-inante
demas-iado
Eso duele..... :((
Este es el fichero de patrones del FBReader.
Ya sabemos de dónde ha salido. Se puede abrir, es un XML. Evidentemente, el problema del Cool Reader es una mezcla del algoritmo utilizado y el aprovechamiento de los ficheros y formato .pdb existente.
es.pattern (http://www.easy-share.com/1908181884/es.pattern)
Spanish hyphenations description for FBReader (original was taken from the teTeX distribution)
From the original /usr/share/texmf-texlive/tex/generic/hyphen/sphyphen.tex file:
% (c) Javier Bezos 1993 1997.
% (c) Javier Bezos and CervanTeX 2001-2006
% Some parts, (c) by Francesc Carmona
% Licence: LPPL
-->
Está con todos en "hyphenationPatterns.zip" , /FBReader/share/zlibrary, además tiene un "es_UTF-8" en "languagePatterns.zip" con 1646 palabras, prefijos, y signos especiales castellano extra.
Creo que tienen razón, tanto tiene pinta como tiene los datos debidos y apropiados suficientes para español, y montones de idiomas más.
El fichero es el mismo que yo uso pero más antiguo. El que yo uso es pone 2001-2009, lo que pasa que para leerlo con python quité todo lo que no necesitaba.
Entonces no lo entiendo. La versión del firm de BeBook que yo utilicé con FBReader separaba todas las palabras correctamente. He leído libros enteros sin ningún error.
Quizás es que los de Bebook adaptaron algo que no se encuentra en la versión de PC. Lo suyo es que os instaléis este firm y empecéis a rebuscar...
Tiene todas las pintas de deberse a la forma en la que se almacenan en memoria los patrones, ya que los de una letra no se puede de la forma que lo hace coolreader. Están clasificados según la primera y la segunda letra, pero para el español se usan patrones de una sola letra, que no se como adaptar según el sistema del coolreader. Temporalmente los convierto a silabas con todas las combinaciones posibles con vocales. Igual no es una buena solución. Estoy estudiando crear mis propios patrones a partir de las reglas de silabación oficiales. A ver que sale.
Tiene todas las pintas de deberse a la forma en la que se almacenan en memoria los patrones, ya que los de una letra no se puede de la forma que lo hace coolreader. Están clasificados según la primera y la segunda letra, pero para el español se usan patrones de una sola letra, que no se como adaptar según el sistema del coolreader. Temporalmente los convierto a silabas con todas las combinaciones posibles con vocales. Igual no es una buena solución. Estoy estudiando crear mis propios patrones a partir de las reglas de silabación oficiales. A ver que sale.
Vamos a tener siempre el problema y limitación de los ficheros .pdb y el algoritmo que los maneja delante, esté implementado de forma o correcta o no en Cool Reader. Fijate que el FBReader maneja los ficheros TeX directos y en crudo.
A ver si podéis probar este nuevo. Lo he generado a partir de las reglas de silabeo del Español. Creo que ya solo falla en los casos que se salen de la regla, en cuyo caso habrá que ir creando patrones exclusivos, y no he tenido en cuenta las ü. Nuevo Fichero de Alan. (http://www.megaupload.com/?d=G4IEKUO5)
NOTA: Acabo de resubir el fichero, había un error y no partía bien las "cl".
A ver si podéis probar este nuevo. Lo he generado a partir de las reglas de silabeo del Español. Creo que ya solo falla en los casos que se salen de la regla, en cuyo caso habrá que ir creando patrones exclusivos, y no he tenido en cuenta las ü. Nuevo Fichero de Alan. (http://www.megaupload.com/?d=G4IEKUO5)
NOTA: Acabo de resubir el fichero, había un error y no partía bien las "cl".
1383 páginas, tio, y ... =D> ^:)^ =D> ^:)^ =D> ^:)^ =D> ^:)^ =D> ^:)^ =D> ^:)^ =D> ^:)^
ch ns rs bs
Me preocupan no obstante las letras, signos, y prefijos especiales españoles, como los incluídos en el "es_UTF-8" de "languagePatterns.zip" del FBReader. ¿Se supone que todo esto también está cubierto y previsto?
Probado en el PC con CR v3.0.16b. A ver si lo puedo probar también en el lector, con alguno de los miles de firmwares, y que funcione.
Bueno, primero tengo que librarme del llevar más de dos horas corriendo sin parar, delante de uno con pintas realmente extrañas, como salido de un libro de Poe >-) , con una navaja en la mano, y gritando no se qué de cochinos o algo así #:-s :-ss
ve-ía , dí-as, existí-an, corrí-an, so-lo, só-lo, habí-an, proponí-an, vendí-an, usá-is, habí-an, entregarí-an, sonre-ír, podrí-ais, galearí-as, atra-ía, seguí-an, condenarí-an, tie-ne, interrumpí-an, pretendí-an, amorí-os, habrí-an, debí-an, viví-an, rafae-la, te-nía, dirigí-an. có-mo, aparecerí-an -> no estan mal, pero se ve rarísima la división, y más cuanto menor es la letra
Ais-ha
anoc-heciera
much-acho
inmens-os -> tampoco es capaz de separar como inmen-sos, sólo in-mensos
ec-haron
luc-har
ec-har
noc-he
cuc-hillo
tens-ión
dic-ho
much-acha
muchac-ha
muc-hacho
escarc-ha
pens-ando
ans-iedad
perdérs-ela
muc-has
noc-hes
noc-he
escuc-haba
hec-ho
cons-entirlo
escuc-hó
porc-he
luc-has
lec-ho
piéns-alo
cons-uelo
cons-eguid
escuc-har
agac-harse
obs-ervó
escuc-hé
muc-hos
derec-ho
pens-ar
ec-hó
descans-aba
pers-onas
cons-ejos
tens-ión
dic-ho
ins-ultos
deshinc-hó
ec-haban
derec-ho
tec-ho
cors-arios
escuc-hó
abs-orto
aprovec-hando
desc-hó
muc-hedumbre
ec-haba
derec-hos
markmtc , ¿sigues por ahí? espero que sí, no te desanimes, hombre :)
Yo tampoco he conseguido dar con los jefazos de Adobe o Sony, pero sí con el de Cool Reader.
Llevo un par de días intercambiando mensajes con Buggins, y tras una ardua y argumentada discusión #:-s
- Podemos enviarle un nuevo fichero "Spanish_hyphen_(Alan).pdb", una vez comprobado y depurado, para inclusión en los firmwares Buggins de test y Cool Reader, incluso en los oficiales, en eso nunca ha habido problema y fue lo primero que ofreció.
- Va a incluir soporte al estilo del CR 3.0.21 desktop, para leer el fichero .pdb, si existe, de SD/crengine/hyph. Esto ralentizará algo la apertura y formateo de los libros, pero es un gran paso adelante y debería usarse sólo con finalidades de test o debug, de forma que cualquiera pueda comprobar y usar sus propios ficheros .pdb, de cualquier lenguaje o lugar del mundo, para luego incluirlos finalmente en las imagenes del fw.
- ¡Dice que les va a enviar este soporte y cambios del código también a los chinos! :o De forma que vendrá ya soportado de base en un futuro para cualquier lector Hanlin V3 y firmware.
Más cosas. Sigo con varios temas. Pero, y aquí todo el mundo si lo desea puede ayudar, se pueden enviar y son bienvenidos:
- Informes de bugs y problemas del Cool Reader y del firmware.
- Ficheros en español actualizados y traducidos para los menús en español, la ayuda y opciones en pantalla, el manual .fb2 incluido, etc.
- Sugerencias de nuevas funciones y cambios. Sin fantasías.
Todo ello argumentado, y de una forma muy clara, breve y concisa. Que hay muchas limitaciones tanto de tiempo como de idioma.
Eso sí, claro, si me vuelve a responder un mensaje o leer alguna vez :D , después del correo con discusión, informe de bugs y sugerencias de cambios que le envié ayer por la tarde O:-)
solsticio
04/11/2009, 17:42
Va a incluir soporte al estilo del CR 3.0.21 desktop, para leer el fichero .pdb, si existe, de SD/crengine/hyph. Esto ralentizará algo la apertura y formateo de los libros, pero es un gran paso adelante y debería usarse sólo con finalidades de test o debug, de forma que cualquiera pueda comprobar y usar sus propios ficheros .pdb, de cualquier lenguaje o lugar del mundo, para luego incluirlos finalmente en las imagenes del fw.
Pues esto útlimo creo que puedo confirmarlo, al menos con el firmware de Buggins que he puesto, el 20091102 (2 de noviebre).
He creado en la tarjeta el /creengine/hyph y en él he puesto el archivo Spanish_hyphen_(Alan).pdb. Aunque no sé si es el generado por el programa python (retocado para que el nombre del fichero generado sea spanis ...) o el directamente bajado de este hilo del foro (renombrado a spanish...) . Creo que ambos hay que gradacerselos a markmtc y desde aquí mi agradecimiento.
Y ya el coolreader de mi papyre ronca un poco menos. :) Ejemplos a primera vista ali-viado donde antes era aliv-iado y ha-cia don antes era hac-ia.
Un abrazo. Solsticio
Va a incluir soporte al estilo del CR 3.0.21 desktop, para leer el fichero .pdb, si existe, de SD/crengine/hyph. Esto ralentizará algo la apertura y formateo de los libros, pero es un gran paso adelante y debería usarse sólo con finalidades de test o debug, de forma que cualquiera pueda comprobar y usar sus propios ficheros .pdb, de cualquier lenguaje o lugar del mundo, para luego incluirlos finalmente en las imagenes del fw.
Pues esto útlimo creo que puedo confirmarlo, al menos con el firmware de Buggins que he puesto, el 20091102 (2 de noviebre).
He creado en la tarjeta el /creengine/hyph y en él he puesto el archivo Spanish_hyphen_(Alan).pdb.
Efectivamente, tanto el último de test de buggins (v3update-cr3-20091102.zip), como el último "oficial" de Lbook "V3update-uk-2.22-20091030.rar" incluyen ya dicho soporte.
Hay que colocarlo bajo la carpeta, creada en la SD, /crengine/hyph. Y no sólo eso, puedes colocar cualquier fichero .pdb, y elegirlos desde el menú de configuración. Si pones uno con el nombre de los antiguamente incluidos en el código (ahora sólo existe silabeo desactivado, activado algorítmico, o ficheros externos .pdb), como el "Spanish_hyphen_(Alan).pdb" te reconoce el nombre del idioma a la antigua usanza en lugar de aparecer el nombre del fichero.
El que mejor funciona por ahora es el correspondiente a este mensaje, http://www.lectoreselectronicos.com/index.php?name=PNphpBB2&file=viewtopic&p=18134#181 34 , "Nuevo Fichero de Alan.", http://www.megaupload.com/?d=G4IEKUO5 , con la salvedad de lo comentado en http://www.lectoreselectronicos.com/index.php?name=PNphpBB2&file=viewtopic&p=18183#181 83 .
solsticio
06/11/2009, 17:58
El que mejor funciona por ahora es el correspondiente a este mensaje, http://www.lectoreselectronicos.com/index.php?name=PNphpBB2&file=viewtopic&p=18134#181 34 , "Nuevo Fichero de Alan.", http://www.megaupload.com/?d=G4IEKUO5 , con la salvedad de lo comentado en http://www.lectoreselectronicos.com/index.php?name=PNphpBB2&file=viewtopic&p=18183#181 83 .
Yo ese es el que usaba pero con unos patrones añadidos más para corregir unas malas separaciones con las que me encontre (ent-re y similares). Intenté corregir la mal separacion de la c-h pero no lo he evitado.
Ahora me he bajado el es.pattern del fbreader, el que tu creo comentabas y que era un poco más antiguo. No he encontrado ninguna mala separación de palabra, incluídas las CH, pero creo que es evitando su separacion. Ejemplo separa bien can-cha pero muchacho no la separa ni bien ni mal, simplemente no la separa.
Sigo probando y ya veré.
De todas maneras, me he pasado por el foro ruso y Buggins dice que va a manejar los ficheros de fbreader directamente. Acaba de sacar un firmware de prueba que dice que lo hace pero no he conseguido que me reconozca ni los .pdb ni los .pattern (del fbreader) así que me he vuelto atrás. Creo que el resultado será el mismo que el que obtengo ahora (pues también usamos el es.pattern del fbreader aunque convertido por el programa de markmtc).
Un abrazo. Solsticio
De todas maneras, me he pasado por el foro ruso y Buggins dice que va a manejar los ficheros de fbreader directamente. Acaba de sacar un firmware de prueba que dice que lo hace pero no he conseguido que me reconozca ni los .pdb ni los .pattern (del fbreader) así que me he vuelto atrás. Creo que el resultado será el mismo que el que obtengo ahora (pues también usamos el es.pattern del fbreader aunque convertido por el programa de markmtc).
Sip, la próxima de test y posiblemente la oficial parece que serán las buenas ya, y una bendición para los usuarios españoles.
La verdad es que el Buggins se está portando. Es una bestia parda pura programando. Sólo le hacen falta ideas, y gente probando las nuevas funciones y avisando de fallos.
Cómo él mismo avisa al final de su mensaje, la que tú comentas falla precisamente en eso, también en el emulador GUI (¿sabíais que se podían probar y crear skins sin tener que crear imagenes con el xml modificado y flashear continuamente? pues eso).
Hay montones de correcciones y funciones nuevas (principalmente, las anunciadas por error en la página de Lbook para el firmware oficial). Las que más nos interesan a los españoles, el algoritmo y las funciones de silabeo totalmente nuevas, soporte para ficheros externos de silabeo, soporte para ficheros de silabeo .pdb y .pattern (posiblemente ficheros .tex directamente en un futuro, y también las opciones de silabeo de OpenOffice), cambio del formato de menús y muchas funciones para hacer sitio a otros idiomas con expresiones y palabras más largas (i.e. español), español ahora integrado, soporte externo para ficheros de idioma adicionales o personalizados (via .po/. mo), uso de fuentes que no incluían alfabeto cirílico, etcétera, etcétera, etcétera.
EDIT:
Ah! Los ficheros del FBReader no son sino una versión modificada de los ficheros .tex , por eso son más anticuados, puede que el programa y los lectores con FBReader (por ej. los Netronix tipo iLiber o Inves) puedan hacer (si se molestan en habilitar la opción y añadir el código, como siempre, claro) mejor el silabeo, pero ni se han molestado en obtener y convertir los últimos ficheros .tex , o sea, que para pruebas, mejor siempre directamente a la fuente ( http://www.ctan.org/tex-archive/language/hyph-utf8/tex/generic/hyph-utf8/patterns/ ) .
solsticio
07/11/2009, 09:18
Hola.
He seguido haciendo pruebas con los .pdb y el conversor de markmtc
Primero anunciar los programas con que los he probado, el coolreader de la version lbook 20091102 y el coolreader para windows 3.0.22.
No me fiaba de tanto patrón en el fichero origen del fbreader (latex, tex y demas orignes). Vi demasiadas reglas. Total que probé a deshacerme de todas aquellas de más de tres caracteres y añadir algunas propias de mi cosecha (nuca de más de tres caráctres entre letras y números). Le pasé el conversor de markmtc y generé el .pdb que resultó de un tamaño de unos 17 kb. Lo aplico tanto al windows como al papyre. Os cuento mis resultados en nada exhaustivos.
1º El windows y el papyre/hanlin se comportan diferentemente a la hora de separar las palabras con el mismo .pdb. Yo me fíó más del comportamiento del papyre que del windows pues creo que es más fiel a las reglas que observo en el fichero de patrones. Es sólo mi opinión.
2º Ejemplos de lo anterior la palabra "propiamente" que el windows se empeña en separar siempre en propi-amente (mal), el hanlin me lo separa en propia-mente (bien) y también como propiamen-te (correcto). Otras palabras, creo también comentadas en el hilo, son inmensos y muchaco, el windows no las separa ni a patadas con el .pdb generado; el hanlin, las separa ambas corectamente, mu-chacho o mucha-cho, e in-menos o inmen-sos.
3º Solo he notado un "error" por decirlo así. El apellido Carnell (ingles) que me ha separado como Carne-ll. Debido a una regla (1ll) que he añadido yo. Claro que no conoczco palabras en castellano acabadas en "ll". No cro muy difícil de subsanar.
No he dedicado mucho tiempo a comprobaciones pero, por lo poco que he visto, he obtenido un buen resultado (al menos en el papyre que es el que me interesa porque en él es donde leo).
Sigo haciendo pruebas. De todas maneras, como hemos comentado, parece que en nuevas versiones, el coolreader va a "soportar" (que palabra más fea) los ficheros del fbreader/tex, etc. directamente. El resultado, supongo, será similar pues los archivos de partida son los mismos o primos-hermanos.
Un saludo. Solsticio.
Comentarte. Tus resultados parecen lógicos; más o menos así los he obtenido yo este tiempo con diversas pruebas, patrones, palabras raras, etc.
1. CR 3.0.22 y 20091102 ya no usan el mismo algoritmo de silabeo. Hasta no aparecer nuevas versiones de test desktop/firmware nuevas, estables y equivalentes, las pruebas tendrías que hacerlas sobre versiones más antiguas o modernas de ambos.
2. Los patrones de la segunda versión del fichero marktmc, por lo que dió a entender parecen confeccionados a partir de las reglas de silabeo del idioma español directamente (el msg. suyo con un link a RedIRIS está por algún sitio), aunque no dejó las fuentes ni hemos podido todavía confirmarlo. Por eso es también mucho más pequeño. Y es el que mejor resultado da, al menos en las versiones antiguas con soporte .pdb tradicional. No deja de ser interesante y curioso.
3. No obstante, pienso yo, si los ficheros .tex llevan tantos años de desarrollo y esfuerzos, y son probados con diversas librerias contra bases de datos de cientos de miles de palabras, alguna razón debe existir y más fiables deberían de ser.
solsticio
07/11/2009, 13:18
3. No obstante, pienso yo, si los ficheros .tex llevan tantos años de desarrollo y esfuerzos, y son probados con diversas librerias contra bases de datos de cientos de miles de palabras, alguna razón debe existir y más fiables deberían de ser.
Eso también pienso yo. Pero me baso en prueba y error con el papyre (donde está centrado mi interés). Añadía patrones simples (por tanto más genericos) para evitar malas particiones y no funcionaban. LLuegué a la conclusión que patrones mayores (por tanto más especifícos) alteraban el resultado. La palabra muchacho no había manera de partirla casi ni con sierra. Simplifiqué y por ahora tengo los mejores resultados con el papyre.
De todas maneras, los ficheros .pattern del fbreader que vienen del tex parecen diseñados a base de prueba y error (lo cual no es malo). Pero en vez de buscar patrones genericos como solución, parecen haber añadido la palabras enteras a lo bestia. Esa es la sensacion que yo tengo viendo el fichero.
Espero impaciente que pronto pueda manejar el .pattern de manera directa. Mas que nada por comodidad. Soy un enamorado de los ficheros texto por la facilidad de manejarlos con un editor más simple o más potente según las necesidades. Yo me creo los fb2 con el doc2fb y luego lo manipulo con el notepad++. No me gusta nada el book designer para fb2, lo veo poco versátil (lo de los guiones largos lo llevo fatal) y demasiado estático.
Un abrazo. Solsticio
P.D: Lo acabo de colgar en megaupload (2ª revisión) :
http://www.megaupload.com/?d=CVAYEOAD
solsticio
08/11/2009, 13:51
Hola
Bueno. He seguido depurando un poco, solo un poco, el fichero .pdb para el coolreader del hanlin para partir bien las palabras. Creo que me ha quedado bastante redondo, al menos las comprobaciones que he hecho. Solo detecto un "error" cuando las palabras terminan en ll, rr, ch (añadiendo unos cuantos patrones creo que podría resolverse pero estoy algo vago). Palabras como Ario-ch, como-rr, o clave-ll (por no llevar vocal o algo más después).
Al menos, personalmente, creo que es un buen punto de partida.
Me gustaría lo pobarais y que se puedieran comentar los posibles fallos.
Este es el enlace:
http://www.megaupload.com/?d=CVAYEOAD
En el fichero esta el .pdb y el .txt del que se ha originado el primero (gracias al programama de markmtc).
Un abrazo. Solsticio.
agostoesquimal
08/11/2009, 15:18
Hola
Muchas gracias por el aporte y por todo tu trabajo.
Se puede utilizar con el firm d lbook d abril?Si no es asi como se utiliza?
Gracias
un saludo
solsticio
08/11/2009, 19:34
Se puede utilizar con el firm d lbook d abril?Si no es asi como se utiliza?
Supongo que si. Yo uso u lbook reciente donde los .pdb hay que situralos en crenginehyph de la SD. Luego en el menu puedes elegir.
Prueba a colocarlos en este direcctorio, si no funciona prueba en crengine. Tal vez tengas que renombrarlo como el ruso Russian_EnUS_hyphen_(Alan).pdb que me parece suele ser la elección por defecto.
Echa un vistazo a anteriores mensajes de este hilo. Creo que te serán de mejor ayuda que lo que yo digo.
Un abrazo. Solsticio.
Nuevas versiones para bajar:
Full V3 update image: http://files.mail.ru/ASIFJO
Win32 simulator: http://files.mail.ru/G6XTOG
Only files: http://files.mail.ru/4PNVW8
New version for testing.
Simulator for Win32: CR3-v3-gui-win32-20091108.zip
Full firmware V3: v3update-CR3-20091108.zip
Only files CoolReader V3: v3update-20091108-libs.tar.gz
- Completely rewritten algorithm hyphenation hyphenation dictionary added support to FBReader
- Added dictionary translations of FBReader (in the list can be seen as en, ru, uk, etc.)
- Fixed problem with garbage characters instead of the small razmeoa for some fonts (which are embedded bitmaps for small sizes)
- Test for the presence of the Cyrillic alphabet is disabled when loading the list of fonts
- Fixed Ukrainian translation
- Reduce font in the content and the bookmark menu
- Fixed not working commands to change the screen orientation
- Parameter. Ini file crengine.cache.filesize.min = N allows you to specify the minimum file size in bytes, which must be saved in the cache (for the subsequent rapid re-opening)
- Parameter. Ini file crengine.progress.show.first.page = 0 will disable the display of the first page of the book in the early boot
- Parameter. Ini file cr3.dlg.fileprops.font.size = N allows you to adjust the font size in the properties of document
Parece que de nuevo no es posible activar el silabeo en esta versión (no he flasheado la imagen), en el GUI, aunque también sigue fallando todavía muchas veces al guardar los valores modificados de la configuración, editando y forzando el uso del fichero .pdb o .pattern correspondiente en el cr3.ini sigue sin poner casi ninguna palabra bien, parece como si los ignorara y siguiera usando el algoritmico.
No sé, mañana intentaré probar algo más.
Flasheado.
En el lector si detecta y usa los ficheros de silabeo, tanto .pdb como .pattern, con resultados sorprendentemente diferentes, incluso para los .pdb y .pattern "oficiales". El que mejor resultado parece dar es el .pattern oficial del FBReader (basado por otra parte en un .tex antiguo, a ver si lo convierto y actualizo), pero a su vez también divide muy pocas palabras. No he tenido tiempo de probar mucho.
Está basado además ya en el última versión oficial 2.22U de Lbook, por lo que lleva los últimos módulos y cambios del ADE para la lectura de los .epub y .pdf.
Además ya muestra también por fin los menús y texto en español desde el ADE si se cambia el idioma a español en el menú de configuración inicial.
He visto ya otros muchos pequeños cambios y bugs corregidos. También he visto que se le ha olvidado cambiar y actualizar alguna cosa, así como un par de detalles nuevos, pero son estéticos.
A falta de probar en profundidad, RECOMENDABLE.
solsticio
09/11/2009, 10:52
En el lector si detecta y usa los ficheros de silabeo, tanto .pdb como .pattern, con resultados sorprendentemente diferentes, incluso para los .pdb y .pattern "oficiales". El que mejor resultado parece dar es el .pattern oficial del FBReader (basado por otra parte en un .tex antiguo, a ver si lo convierto y actualizo), pero a su vez también divide muy pocas palabras. No he tenido tiempo de probar mucho.
Lo que más me ha sorprendido es el tratamiento de los .pdb. Ahora muy diferente que en las versiones 20091030 y 20091102. Ha ido a peor. He notado que corta muchas menos palabras que antes e incluso algunas de manera diferente (y ahora de forma errónea).
Un saludo. Solsticio.
Si no es mucho pedir para los "expertos", podría alguien decir para qué vale el "coolreader" y si hay que instalarlo.
Seguro que, entre amantes de la lectura, alguien sabe explicarlo en pocas palabras.
Gracias.
No soy ningún experto; pero el cool reader te sirve para leer el fb2 en el ordenador. O simplemente para abrirlo y comprobar que funciona el archivo o la corrección que estás añadiendo al fb2.
Gracias, the_doc.
Todo bien explicado y brevemente.
Muy agradecido.
Joserri
En el lector si detecta y usa los ficheros de silabeo, tanto .pdb como .pattern, con resultados sorprendentemente diferentes, incluso para los .pdb y .pattern "oficiales". El que mejor resultado parece dar es el .pattern oficial del FBReader (basado por otra parte en un .tex antiguo, a ver si lo convierto y actualizo), pero a su vez también divide muy pocas palabras. No he tenido tiempo de probar mucho.
Lo que más me ha sorprendido es el tratamiento de los .pdb. Ahora muy diferente que en las versiones 20091030 y 20091102. Ha ido a peor. He notado que corta muchas menos palabras que antes e incluso algunas de manera diferente (y ahora de forma errónea).
Un saludo. Solsticio.
Pues yo veo que parte demasiadas palabras y de forma diferente (creo que en eso te estas refiriendo a los .pdb "personalizados", o el tuyo con muy pocos patrones), aparte de incorrecta como bien dices. Creo que está intentado aplicar el mismo algoritmo de silabeo tanto a los archivos .pdb como a los .pattern. Se suponía que iba a dejar el código .pdb sin tocar (aunque fuera malo), y que el código para los .pattern y/o .lex iría por otro sitio.
Sin embargo, me gusta más como deja la lectura los .pattern, no parte muchas palabras, y cuando lo hace es para lineas que quedarían con el espaciado entre palabras demasiado visible. Vamos, sería como leer con el silabeo desactivado, pero sí hacerlo cuando el resultado fuera demasiado cantoso.
Habrá que seguir experimentado y corregir y ajustar cosas.
Buah! Se le ha colado un fichero de español para los menús, no ya la última versión, sino que ha retrocedido dos o tres.
Aquí os dejo el último:
http://www.easy-share.com/1908386810/es_v1.4.rar
Hay que colocarlo en /crengine/i18n/
solsticio
09/11/2009, 13:02
No soy ningún experto; pero el cool reader te sirve para leer el fb2 en el ordenador. O simplemente para abrirlo y comprobar que funciona el archivo o la corrección que estás añadiendo al fb2.
Y que tiene una version para el hanlin/papyre/etc con la que abrimos los libros (en formato fb2) al usar nuestro lector dependiendo del firware instalado en el mismo.
Un abrazo. Solsticio
solsticio
09/11/2009, 14:42
Sin embargo, me gusta más como deja la lectura los .pattern, no parte muchas palabras, y cuando lo hace es para lineas que quedarían con el espaciado entre palabras demasiado visible. Vamos, sería como leer con el silabeo desactivado, pero sí hacerlo cuando el resultado fuera demasiado cantoso.
Cierto, parece reacio a cortar. Pero yo creo que algunas veces le queda cantoso como dices. Los cánticos son más cantosos cuando aumentas el tamaño de letras.
Yo creo que debería partir siempre que pueda, como hacía antes. Para evitar particiones ya tenemos la opcion "sin silabeo".
Una estadística. un libro de 1445 paginas sin silabeo (como pone en las opciones). 1417 con el silabeo algorítmico. 1441 con es.pattern de FBreader (casi ninguna diferencia con sin silabeo), 1430 con el .pdb (en versiones anteriores con este .pdb salían 1421 y las palabras bien cortadas). Efectivamente se muestra reacio a partir salvo cuando usamos el silabeo algorítmico.
Por cierto, cuando cambias de opción en silabeo tienes que forzar un "formateo" para que no haga cosas raras (bien volviendo a leer el libro, o aumentando y disminuyendo el tamaño de la fuente).
Un saludo. Solsticio.
He creado un nuevo fichero .pattern a partir del último fichero .tex/utf-8. Parece que silabea bien.
http://www.easy-share.com/1908390370/esJOTAS.rar
Pensaba que el .pattern iba a tener una estructura más compleja, o diferente en orden, pero no veo ninguna jerarquía especial para ir colocando o comprobando los patrones; al principio parecía que iban ordenando alfabéticamente, y luego los patrones según la longitud y los cortes, pero después aparecen para las palabras empezando por (x) letra o (x)n letras a lo largo de todo el archivo, más bien parece un caos y que han ido copiando patrones y palabras arriba y abajo sin más. Por tanto probé, después de convertir el .tex, a dejar su orden original tal cual.
No soy ningún experto; pero el cool reader te sirve para leer el fb2 en el ordenador. O simplemente para abrirlo y comprobar que funciona el archivo o la corrección que estás añadiendo al fb2.
Y que tiene una version para el hanlin/papyre/etc con la que abrimos los libros (en formato fb2) al usar nuestro lector dependiendo del firware instalado en el mismo.
Un abrazo. Solsticio
Hola Solsticio:
Pregunto, por favor, dónde se adquiere esa versión para el Papyre, qué firmware hay que tener...
Y ¿se instala dentro del Papyre? ¿Cómo se ejecuta luego?
Perdón para un novato :x
solsticio
10/11/2009, 08:46
Y que tiene una version para el hanlin/papyre/etc con la que abrimos los libros (en formato fb2) al usar nuestro lector dependiendo del firware instalado en el mismo.
Pregunto, por favor, dónde se adquiere esa versión para el Papyre, qué firmware hay que tener...
Y ¿se instala dentro del Papyre? ¿Cómo se ejecuta luego?
No se instala dentro del papyre; viene incorporado con la mayoría de firmwares (algunos llevan fbreader en vez de coolreader). El coolreader es el programa que se ejecuta en el papyre cuando eliges leer un libro en formato .fb2 (a lo mejor con algun otro formato).
Hay distintas versiones. Las más actuales suelen venir en los firmwares de pruebas lbook, que algunos estamos comentando por aquí.
Un saludo. solsticio
Muchísimas y muchas gracias, solsticio.
Estoy aprendiendo mucho, gracias a los que contestáis.
Si no, sería perdernos en un océano de dudas >:D<
Un saludo cordial,
Joserri
solsticio
13/12/2009, 09:43
He creado un nuevo fichero .pattern a partir del último fichero .tex/utf-8. Parece que silabea bien.
http://www.easy-share.com/1908390370/esJOTAS.rar
Pues el otro día trasteando yo cree otro:
http://www.megaupload.com/?d=CVAYEOAD
Pensaba que el .pattern iba a tener una estructura más compleja, o diferente en orden, pero no veo ninguna jerarquía especial para ir colocando o comprobando los patrones; al principio parecía que iban ordenando alfabéticamente, y luego los patrones según la longitud y los cortes, pero después aparecen para las palabras empezando por (x) letra o (x)n letras a lo largo de todo el archivo, más bien parece un caos y que han ido copiando patrones y palabras arriba y abajo sin más. Por tanto probé, después de convertir el .tex, a dejar su orden original tal cual.
Los patrones con vocal con tilde y Ñ no parecen funcionar bien aunque yo los he añadido como con otras vocales y consonantes.
Con este fichero es menos reacio a particionar aunque le sigue costando, al menos le cuesta más que con los anteriores .pdb (que lamentablemente dejan de funcionar).
Un abrazo. Solsticio
P.D: Retomo este hilo pues le tengo especial cariño dado que es el que hizo soltarme de dedos al teclado. 8-)
---
* Origin: Dedicado a mis tiempos en FidoNet. ;-)
solsticio
15/12/2009, 10:28
Hola.
Pues al final seguí haciendo pruebas. Quiero comentaros algunas diferencias que creo haber descubierto entre el silabeo de la última versión del coolreader (20091108) y las anteriores.
Desde luego ha cambiado el algoritmo de hyphenation. Antes usaba .pdb, que nosotros podíamos originar gracias al programa de markmtc desde los .pattern. Yo pensaba que habían dejado de funcionar pero he podido comprobar que no es así. Lo que ha dejado de funcionar son patrones de de 2 caracteres (4A) e incluso los de 3 dan problemas según mis comprobaciones, tanto en .pattern como en los .pdb basados en los anteriores (por eso pensaba que los .pdb habían dejado de funcionar)
Yo originé un .pattern con patrones de 4 caracteres todos (2 letras y 2 numeros siempre empezando por 2, es el que podeís encontrar en el mensaje anterior) que creo que funciona bastante bien. Me ha dado por compilarlo con el programa de markmtc y generar el .pdb correspondiente y probarlos con la última versión del coolreader.
El funcionamiento del .pdb y del .pattern son muy similares. Es mejor el del .pdb pues soluciona una de las pegas que he encontrado al .pattern (ver mensaje anterior) y que era que no partía si antes de guión había una vocal con tilde, con el .pdb lo hace. Sigue sin hacerlo si tras guión viene Ñ.
Mi conclusión por tanto para la nueva versión de Coolreader. Mejor el .pdb al .pattern en funcionamiento (da mejor resultado). Mejor el .pattern respecto al .pdb en cuanto a manejabilidad por ser un fichero texto.
Respecto a versiones anteriores, creo que el tratamiento del silabeo ha empeorado al tener problemas con los patrones de 2 y/o 3 caracteres. Por ello funciona defectuosamente si ponemos directamente el .pattern que viene del fbreader ( y por tener también demasiados patrones ). Practicamente hay que generar un .pattern de cero.
Me ha llevado trabajo conseguir que el nuevo coolreader "silabee" de manera decente en la nueva versión debido al nuevo tratamiento.
Ahora un poco de estadísticas que podeís hacer vosotros mismos. Es mirar el número de paginas que obtenéis de un libro aplicando un algoritmo u otro. Yo os pongo las mias. Se supone que menos páginas quiere decir mejor "silabeo"
928 con coolreader y .pdb de versiones previas de coolreader y de .pdb
932 tanto con .pattern como de su pdb en la última versión de coolreader. En otro libro de más páginas me da que 1616 con .pdb frente a 1617 .pattern. No lo he probado con versiones previas de coolreader.
Dejo todos los archivos aquí por si os apatece. Me gustaría los probarais para encontrar posibles malas particiones y subsanarlas.
http://www.megaupload.com/?d=CVAYEOAD
Un abrazo y perdón por el rollazo. ;-)
Solsticio
---
* Origin: Demasiado viejo para morir joven, demasiado joven para morir
Pues al final seguí haciendo pruebas. Quiero comentaros algunas diferencias que creo haber descubierto entre el silabeo de la última versión del coolreader (20091108) y las anteriores.
Solsticio, gracias por seguir dándole vueltas al tema, y tus continuas mejoras y ficheros. Sobre todo ahora que Buggins sigue en algún sitio de la isla de Lost y quien sabe cuando aparecerá y con qué novedades.
Desde hace un par de días tengo instalado y estoy probando tu anterior .pattern ... va muchísimo mejor. Acostumbrado a lo anterior, al principio se me hacía hasta raro leer y me parecía increíble tanto silabeo. La lectura con el último Lbook/CR se aproxima mucho más al ideal. Llevo unas trescientas páginas y algo, y sólo encontré dos palabras mal divididas, que no apunté, mea culpa.
A ver si instalo este nuevo que has puesto hoy.
rafalele
15/12/2009, 20:50
Muchas gracias a jotas y solsticio por vuestros aportes.
He puesto el fichero pdb de solsticio con el firmware de buggins del 8/11/2009, que lo he puesto por la insistencia de jotas en sus "maravillas" y ¡¡¡voila, funciona!!!
Lo dicho, gracias.
solsticio
16/12/2009, 07:20
Desde hace un par de días tengo instalado y estoy probando tu anterior .pattern ... va muchísimo mejor. Acostumbrado a lo anterior, al principio se me hacía hasta raro leer y me parecía increíble tanto silabeo. La lectura con el último Lbook/CR se aproxima mucho más al ideal. Llevo unas trescientas páginas y algo, y sólo encontré dos palabras mal divididas, que no apunté, mea culpa.
A ver si instalo este nuevo que has puesto hoy.
El problema viene del cambio del algoritmo de hyphenation. Antes, segun creo yo, por defecto partía y con el fichero de patrones tenías que indicarle donde no hacerlo. En la última versión creo es al reves, por defecto no parte, en los patrones es donde debes indicarlo donde partír la palabra. Es por esto que los ficheros de patrones anteriores (como el del fbreader y el tuyo) partían tan poco.
Los patrones de 2 caracteres ahora no servían para nada. Los de tres cifras, ejemplo ("a1d" "a1l") para obtener cosas como la-do y po-lo, funcionaban mal a añadir patrones y no funcionaba con con caracteres después de guión. Prueba tonta sustituir los 3 caracteres por cuatro (a1d pasa 2a1d). El resultado debería ser el mismo pero no, empezó a funcionar correctamente (repol-lo pasó a ser repo-llo y partía con 2 caracteres solo tras guión) . No sé bien por que pero funcinaba mejor, lo achacaré a que 20091108 es versión de prueba. Conclusión: fichero relleno a base de patrones de cuatro caracteres.
Un abrazo. Solsticio
El problema viene del cambio del algoritmo de hyphenation.
He estado un rato mirando el código de silabeo del CR/Buggins, puf! vaya cacao (aunque al final sean unas pocas de lineas birrias en C++ , el problema es la conexión con el resto del sistema). Parte del código antiguo de Alan original, parcheado por Buggins, re-parcheado para los .pdb, re-re-parcheado para el silabeo algoritmico, re-re-re-parcheado para los .pattern, etc, no me extraña que no funcione bien.
Más o menos he visto dónde puede estar el problema, aunque no me queda claro del todo y, por otra parte, ¿merece la pena, o perder más el tiempo con ello? Aunque podamos modificarlo y parchearlo, y compilar desde las fuentes el Cool Reader de nuevo, eso tiene los días contados y es un callejón sin salida.
Además, comparando códigos, lenguajes, y buscando implementaciones del algoritmo usado en el TeX y el OpenOffice, me he encontrado con una libreria justo en C++ que puede ser un chollo para el Buggins, y alternativa a la libhyphen de Debian. No sé si la conocerá o si ya estaba haciendo algo, o ha hecho, al respecto, pero le he mandado un mensaje con toda la información a ver si también pudiera aparecer, volver de vacaciones, resucitar, o algo así, a ver que sucede y si suelta en que anda metido.
http://bugs.debian.org/cgi-bin/bugreport.cgi?bug=471312
http://swolter.sdf1.org/software/libhyphenate.html
* Package name : libhyphenate
Version : 1.0.0
Upstream Author : Steve Wolter <debian@swolter.sdf1.org>
* URL : http://swolter.sdf1.org/software/libhyphenate.html
* License : LGPL
Programming Lang: C++
Description : An hyphenation library for C++
This library provides an implementation of Frank Liangs hyphenation
algorithm, better known as the TeX hyphenation algorithm, for C++.
libhyphenate1 supports English, German, French and Spanish out of
the box, and every site with a TeX installation can distill its
TeX hyphenation files for more languages. In contrast to the libhnj
implementation, this one isn't broken.
libhyphenate v1.1 released
Filed under: libhyphenate ? Thiton at 01:54
I proudSPAMly present you the verSPAMsion 1.1 of libSPAMhySPAMphenSPAMate. UTF-8 charSPAMacSPAMters are now hanSPAMdled corSPAMrectSPAMly and some bugs were purged. UnSPAMforSPAMtuSPAMnateSPAMly, I had to add glib-2.0 deSPAMpenSPAMdence to enSPAMable the UTF-8 hanSPAMdling.
On the funcSPAMtionSPAMalSPAMiSPAMty side, a lot hapSPAMpened: The libSPAMhySPAMphenSPAMate not onSPAMly corSPAMrectSPAMly hySPAMphenSPAMates whole texts inSPAMstead of sinSPAMgle words, but can alSPAMso deSPAMterSPAMmine the best hySPAMphenSPAMation point to fit the text inSPAMto a givSPAMen width - just what you need to imSPAMpleSPAMment fixed-width columns.
solsticio
17/12/2009, 08:11
Más o menos he visto dónde puede estar el problema, aunque no me queda claro del todo y, por otra parte, ¿merece la pena, o perder más el tiempo con ello? Aunque podamos modificarlo y parchearlo, y compilar desde las fuentes el Cool Reader de nuevo, eso tiene los días contados y es un callejón sin salida.
No, salvo que lo hagas como satisfación personal (que no es poco).
Lo mejor es dar tiempo al Buggins. No olvidemos que estamos en una versión de prueba y en la primera versión del hyphenate tras el cambio de algoritmo.
De todas maneras, si te animas, te puedo echar una mano. He programado para linux y Debian es mi distribución de toda la vida. Disfruto con un enano "destripando" todos los aparatos que puedo. ;-)
Un abrazo. Solsticio.
Más o menos he visto dónde puede estar el problema, aunque no me queda claro del todo y, por otra parte, ¿merece la pena, o perder más el tiempo con ello? Aunque podamos modificarlo y parchearlo, y compilar desde las fuentes el Cool Reader de nuevo, eso tiene los días contados y es un callejón sin salida.
No, salvo que lo hagas como satisfación personal (que no es poco).
Lo mejor es dar tiempo al Buggins. No olvidemos que estamos en una versión de prueba y en la primera versión del hyphenate tras el cambio de algoritmo.
De todas maneras, si te animas, te puedo echar una mano. He programado para linux y Debian es mi distribución de toda la vida. Disfruto con un enano "destripando" todos los aparatos que puedo. ;-)
Un abrazo. Solsticio.
Hay vida!!!
Respuesta completa típica de ruso después de dos meses sin noticias y montones de mensajes pendientes, bugs, sugerencias, preguntas, etc. :D :))
Thank you! I?ll look at it?
Recupero este hilo, que es el que debería estar arriba realmente para cuestiones "tesnicas" sobre el interminable periplo del silabeo, mientras que el otro debería ser más para cuestiones sencillas de instalación y uso.
El primer mensaje del primer autor, en un lugar no muy lejano a la Mancha, de cuyo nombre no quiero acordarme, ha sido realmente un catalizador para una reacción explosiva y útil por parte de todos los usuarios del [s:c7c4680ea5]Papyre[/s:c7c4680ea5] con onda expansiva hasta los niveles más altos de otras lenguas y lugares lejanos.
solsticio
22/12/2009, 08:31
Recupero este hilo, que es el que debería estar arriba realmente para cuestiones "tesnicas" sobre el interminable periplo del silabeo, mientras que el otro debería ser más para cuestiones sencillas de instalación y uso.
Pues estupendo. A este hilo tengo espcial cariño. Lástima que Markmtc haya dejado de dar señales de vida.
El primer mensaje del primer autor, en un lugar no muy lejano a la Mancha, de cuyo nombre no quiero acordarme, ha sido realmente un catalizador para una reacción explosiva y útil por parte de todos los usuarios del [s:c7be339540]Papyre[/s:c7be339540] con onda expansiva hasta los niveles más altos de otras lenguas y lugares lejanos.
¿ Y del ingenioso hidalgo Buggins se sabe algo? Según un mensaje tuyo anterior parece que había asomado la patita por debajo de la puerta. :-?
Un abrazo. Solsticio.
P.D: He ido revisando el hilo y he ido sustituyendo los enlaces a los archivos de silabeo por la útlima versión. Para que haya la menor confusión posible con tantas versiones
¿ Y del ingenioso hidalgo Buggins se sabe algo? Según un mensaje tuyo anterior parece que había asomado la patita por debajo de la puerta. :-?
Sin noticia alguna en ningun frente. Estará liado atacando los molinos chinos...
solsticio
23/12/2009, 17:30
Sin noticia alguna en ningun frente. Estará liado atacando los molinos chinos...
¿Bueno o malo?. Esperemos que sea una pausa dedicada a la actividad creativa. :)
Un Abrazo. Solsticio
Sin noticia alguna en ningun frente. Estará liado atacando los molinos chinos...
¿Bueno o malo?. Esperemos que sea una pausa dedicada a la actividad creativa. :)
Un Abrazo. Solsticio
Y volviendo a este histórico hilo :) , ¡qué tampoco fue hace tanto! Y tantas sorpresas, reacciones, novedades, cambios y cosas buenas a traido a los españolitos, los silabeos, los "Cool Readers", los "firmwares", etc...
¿Al final, los patrones esos de a 4, en qué te basaste para crearlos?
Lo digo porque, al recuperar el tema del nuevo fichero ligeramente mejorado de silabeo, y ya que Buggins lleva un par de meses con la promesa pendiente de implementar un silabeo decente, correcto y completo, basado en los ficheros .tex, y además últimamente parece haber perdido un poco el norte, me ha dado en un rato por ver que podría solucionar en el silabeo inglés, pillando el fichero .tex completo original, convirtiendo, y fusilándome todo patrón que no sea de longitud 4. Se me quedan sólo en unos 1200, pero, de funcionar, igual que el esJOTAS.pattern completo, parecido y nanain :(
solsticio
02/02/2010, 09:59
¿Al final, los patrones esos de a 4, en qué te basaste para crearlos?
Si bien recuerdas, para antes del cambio del algoritmo, yo creé uno para las versiones anteriores con patrones
de 2 y 3 caracteres como máximo. Pensaba y sigo pensando que son suficientes salvo para excepciones.
No funcionaba en las nuevas versiones.Observé que el cool por defecto no partía y con los patrones tenías que indicarle donde hacerlo (en versiones previas era al revés, partía y debías indicarle donde no hacerlo). Así que preparé el archivo adaptado a la nueva necesidad de indicar donde partir (antes indicabas donde no partir). Por tan preparé un arhivo con patrones de 3 (a1d, m1p) . No funcionó. :(
Observé el archivo es.pattern y tu esJOTAS.pattern y observé los patrones que si producían particiones (pocas pero los había). Busque estos casos y vi que correspondían (más o menos) a patrones de 4 caracteres. Fue entonces cuando al fichero de 3 patrones se me ocurrió convertirlo a 4 , es decir a1d lo pase a 2a1d y lo mismo para el resto. El resultado debía ser el mismo pues es lo mismo a1d que 2a1d (en teoría). Pensé que seguiría sin funcionar y mi sorpresa fue cuando las particiones eran correctas. :-?
Sigue fallando en la mayoría de palabras grandes que se niega a partir. Es curioso, la palabra propia la parte (pro-pia) pero no hay manera de que propiamente la parta en pro-piamente (si hace propia-mente) y así muchos casos con palabras largas. Eso es lo que quería mirar en el código y he sido incapaz de ver (aunque no desespero)
me ha dado en un rato por ver que podría solucionar en el silabeo inglés, pillando el fichero .tex completo original, convirtiendo, y fusilándome todo patrón que no sea de longitud 4. Se me quedan sólo en unos 1200, pero, de funcionar, igual que el esJOTAS.pattern completo, parecido y nanain :(
Te sale más rentable partir de cero. Tendrás que indicar donde hacer el corte, pudiendo omitir donde no hacerlo. Tendrás el problema de 2 consonantes finales más agravado que en castellano. Si consigues resolver esto sin que el remedio sea peor que la enfermedad me lo cuentas. ;)
Te sale más rentable partir de cero. Tendrás que indicar donde hacer el corte, pudiendo omitir donde no hacerlo. Tendrás el problema de 2 consonantes finales más agravado que en castellano. Si consigues resolver esto sin que el remedio sea peor que la enfermedad me lo cuentas. ;)
Ya veo. Chungo. Una de las grandes diferencias de los ficheros .tex/.pattern español e inglés es que este último no contiene el elevadísimo número de patrones de a 3 que sí se incluyen y usan como cosa muy particular y necesaria para el idioma español.
En el papyre leo en inglés sin silabeo. Los ficheros que hay lo hacen demasiado mal. Pero yo he visto también ediciones inglesas baratas en papel donde cortaban las palabras donde les daban la gana. Supongo que será algo complicado de hacer.
¿Los programas editores de texto profesionales hacen bien el silabeo en inglés?
Funcionando con vBulletin® Version 4.2.5 Copyright © 2026 vBulletin Solutions, Inc. All rights reserved.