PDA

Ver la versión completa : Aqui va una RECETA que no funciona para "ABC.es"



KRorschachZ
21/01/2011, 15:28
Aqui va una RECETA que no funciona para "ABC.es"

pues asi, he puesto los rss que indican en ABC, pero calibre no se los traga, creo que falta algo, pero ahora no caigo...





class AdvancedUserRecipe1295623613(BasicNewsRecipe):
title = u'ABC.es news'
oldest_article = 2
max_articles_per_feed = 55

feeds = [(u'Portada ABC', u'http://www.abc.es/rss/feeds/abcPortada.xml'), (u'Ultima hora', u'http://www.abc.es/rss/feeds/abc_ultima.xml'), (u'Internacional', u'http://www.abc.es/rss/feeds/abc_Internacional.xml'), (u'Espa\xf1a', u'http://www.abc.es/rss/feeds/abc_EspanaEspana.xml'), (u'Economia COMP', u'http://www.abc.es/rss/feeds/abc_Economia.xml'), (u'Medios y Redes', u'http://www.abc.es/rss/feeds/ABC_Medios_Redes.xml'), (u'Tecnolog-Cienc', u'http://www.abc.es/rss/feeds/abc_Ciencia_Tecnologia.xml'), (u'Sociedad', u'http://www.abc.es/rss/feeds/abc_Sociedad.xml')]





saludos.

rickydh
02/02/2011, 01:18
Hola.

Aún no me ha llegado el Kindle pero me he liado con el Calibre mientras.

Mira este código a ver que tal:


__license__ = 'GPL v3'
__author__ = 'Ricardo Jurado'
__copyright__ = 'Ricardo Jurado'
__version__ = 'v0.1'
__date__ = '02 February 2011'

'''
http://www.abc.es/
'''


class AdvancedUserRecipe1296604369(BasicNewsRecipe):

title = u'ABC'
publisher = u'Grupo VOCENTO'

__author__ = 'Ricardo Jurado'
description = 'spanish dayly newspaper'

title = u'ABC'
oldest_article = 2
max_articles_per_feed = 5
no_stylesheets = True
use_embedded_content = False
encoding = 'ISO-8859-1'
remove_javascript = True
language = _('Spanish')

keep_only_tags = [
dict(name='h3', attrs={'class':['overhead']}),
dict(name='h1', attrs={'class':'headline'}),
dict(name='h3', attrs={'class':['subhead']}),
dict(name='div', attrs={'class':'photo-alt1'}),
dict(name='div', attrs={'class':'text'}),
]
feeds = [
(u'PORTADA', u'http://www.abc.es/rss/feeds/abcPortada.xml')
,(u'ULTIMAS', u'http://www.abc.es/rss/feeds/abc_ultima.xml')
,(u'CULTURA', u'http://www.abc.es/rss/feeds/abc_Cultura.xml')
,(u'LIBROS', u'http://www.abc.es/rss/feeds/abc_Libros.xml')
,(u'OCIO', u'http://www.abc.es/rss/feeds/abc_Ocio.xml')
]


--
Saludos.

tolyluis
02/02/2011, 18:29
Hola buenaaass:

No conocía este web hasta esta tarde, yo por mi parte he ido trasteando con Calibre (que programazo) y sus recetas y ya he hecho mis primeros pinitos en el foro de mobileread (http://www.mobileread.com/forums/forumdisplay.php?f=228).

Me encanta ver que hay foros en español sobre el tema de ereaders y demas que el inglés no es mi fuerte.

Echare un vistazo a ese codigo rickydh ;)

rickydh
02/02/2011, 19:55
Hola tolyluis.

He visto tus mensajes en el foro que comentas.

Así que no te extrañe la "similitud" de la cabecera del código. :-)

De hecho han sido tus mensajes los que me animaron a intentar crear
la versión de ABC.

Gracias.

--
Saludos.

tolyluis
02/02/2011, 20:41
Oye no es peloteo ni nada, ¡pero se ve de lujo! =D> , por lo menos en Firefox

Eso si te recomiendo cambiar una cosa:


language = _('Spanish')

Ponlo mejor así (y en términos generales, cualquiera que haga una receta, lo suyo es que lo ponga como te voy a decir)


language = 'es_ES'

Y siempre con ese formato, donde el primer "es" va a indicar a los desarrolladores de Calibre en que idioma es la receta y el segundo "ES" va a indicar la procedencia. Esto es importante para así poder organizar las recetas y que los hispanohablantes no nos volvamos locos a la hora de elegir una receta de nuestro gusto. En teoría estos cambios los veremos en futuros lanzamientos de Calibre.

También te quiero comentar que te faltan un chorraco de feeds de la web de ABC por meter en la receta, quizás eso sea un problema por que seguro que habrá secciones "raras" que no se muestren bien y necesiten un retoque de código. Mete poco a poco feeds nuevos, create un archivo .recipe y vete probando con el comando:


ebook-convert abc.recipe output_dir --test -vv

Si no sabes bien de lo que te hablo pregunta sin miedo y me explayo :\') .

EDITADO--> También te sugiero que cambies el título (title) por que seguro que habrá ABC en todos los laos (de momento hay tres recetas en Calibre con ABC en el título) Puedes poner p.e. "ABC.es" o algo así para distinguirlo.

rickydh
03/02/2011, 19:47
Gracias por los consejos.

Lo ideal es que todo el que quiera vaya realizando las aportaciones que crea convenientes.

Aqui va con algunos feeds añadidos.


__license__ = 'GPL v3'
__author__ = 'Ricardo Jurado'
__copyright__ = 'Ricardo Jurado'
__version__ = 'v0.2'
__date__ = '03 February 2011'

'''
http://www.abc.es/
'''


class AdvancedUserRecipe1296604369(BasicNewsRecipe):

title = u'ABC.es'
publisher = u'Grupo VOCENTO'

__author__ = 'Ricardo Jurado'
description = 'spanish dayly newspaper'

title = u'ABC.es'
oldest_article = 2
max_articles_per_feed = 10
no_stylesheets = True
use_embedded_content = False
encoding = 'ISO-8859-1'
remove_javascript = True
language = 'es_ES'

keep_only_tags = [
dict(name='h3', attrs={'class':['overhead']}),
dict(name='h1', attrs={'class':'headline'}),
dict(name='h3', attrs={'class':['subhead']}),
dict(name='div', attrs={'class':'autor'}),
dict(name='div', attrs={'class':'date'}),
dict(name='div', attrs={'class':'photo-alt1'}),
dict(name='div', attrs={'class':'text'})
]
feeds = [
(u'PORTADA', u'http://www.abc.es/rss/feeds/abcPortada.xml')
,(u'ULTIMAS', u'http://www.abc.es/rss/feeds/abc_ultima.xml')
,(u'NACIONAL', u'http://www.abc.es/rss/feeds/abc_EspanaEspana.xml')
,(u'INTERNACIONAL', u'http://www.abc.es/rss/feeds/abc_Internacional.xml')
,(u'OPINION', u'http://www.abc.es/rss/feeds/abc_opinioncompleto.xml')
,(u'ECONOMIA', u'http://www.abc.es/rss/feeds/abc_Economia.xml')
,(u'CIENCIA Y TECNOLOGIA', u'http://www.abc.es/rss/feeds/abc_Ciencia_Tecnologia.xml')
,(u'CULTURA', u'http://www.abc.es/rss/feeds/abc_Cultura.xml')
,(u'LIBROS', u'http://www.abc.es/rss/feeds/abc_Libros.xml')
,(u'ESPECTACULOS', u'http://www.abc.es/rss/feeds/abc_Espectaculos.xml')
,(u'DEPORTES', u'http://www.abc.es/rss/feeds/abc_Deportes.xml')
]

--
Saludos.

tolyluis
03/02/2011, 21:22
¿Te está haciendo falta retocar el código con los nuevos feeds?

Lo ideal (en mi opinión) es que pacientemente hagas lo que puedas y que si te quedas atascado pregunta (aquí o en mobileread o en al web amiga). Cuando lo tengas acabado (o lo mejor posible) publícalo en mobileread y a ver si lo quieren meter en Calibre. Este nuevo código no lo he testeado, pero desde luego el de ayer se veía muy bien (y sin necesidad de extra-css)

rickydh
03/02/2011, 21:46
No que haya visto, aunque si hay noticias que las fotos (o videos, obviamente) no salen.

Cuando sale el típico "slide" de fotos, se queda el hueco en blanco.

Por ahora no lo he mirado muy a fondo. Quizás es que las carga con javascript.

Se aceptan sugerencias :-)

No puse más feeds al principio porque lo estaba programando en un netbook y me tardaba
mucho en generar el resultado. Netbook que por cierto me petó cuando instalé el Calibre desde
la web, porque no tenía espacio en la partición.

Ahora tengo Ubuntu 10.10 (antes la 9.10 creo recordar). :-)

Y he dejado el Calibre para el PC "grande". Que diferencia de velocidad!

PD: aún no tengo el kindle y no se como se ve en un ebook de verdad (solo en el Calibre).

tolyluis
03/02/2011, 22:00
No, no hay javascript en tu receta :p

Respecto a lo de como se vería en un kindle, hay un programa de Amazon para windows llamado Kindle Previewer 1.5 (http://http://www.amazon.com/gp/feature.html?ie=UTF8&docId=1000234621) que "emula" como se vería un .mobi en tu kindle (tiene algunos fallos de caracteres que el kindle 3 no tiene en realidad, pero te haces una idea que como queda en un kindle). No se que tal iría con WINE por ejemplo.

EDITADO--> Mira este pantallazo en debian para que te hagas una idea

http://www.publicarfotos.com/carpeta/1/thumbs/799791296772422.jpg (http://www.publicarfotos.com/foto_gratis-f215-a1)

rickydh
03/02/2011, 22:58
No, en la receta ya se que no. :-)

Me refería a la web de ABC, que tal vez haga la carga de imagenes del
"slide" con javascript.

Buscaré a ver si encuentro como mostrarlas.

Cuando me líe a probar los cambios de tipos según tittular, texto, ... ya te freiré a preguntas. :-)

--
Saludos.

Quest10
04/02/2011, 01:46
Para probar una receta es muy útil lanzar el comando
ebook-convert myrecipe.recipe output_dir --test -vv desde consola. Por defecto solo comprueba dos feeds, así que las pruebas las hace más rápidas, a pesar de poder tener una infinidad de feeds. Un consejo, haz la prueba en un directorio limpio porque te lo llenará de archivos. Y por último creo recordar que la dirección de salida tenía que ser completa. Espero que os sirva

tolyluis
04/02/2011, 22:08
Bueno pues ya ha salido la version 0.7.44 de Calibre y se han aplicado los cambios al organizar las recetas españolas, se ve ahora de una forma más clara

http://www.publicarfotos.com/carpeta/1/thumbs/141601296854337.jpg (http://www.publicarfotos.com/foto_gratis-f239-a1)

Foto en una Ubuntu 10.04 LTS 64 bits

Lo que parece ser es que en el tema de organización de recetas han optado por dejar como idioma si la receta es de un sitio de España en formato:


language = 'es'

Si la receta es de otro país hispanohablante se pondria por ejemplo



language = 'es_AR'

language = 'es_UY'


Da gusto ver como en Calibre recogen las sugerencias de los usuarios, un 10 para ellos en esto (y en todo, en general)

rickydh
06/02/2011, 11:16
Poquito a poco...


__license__ = 'GPL v3'
__author__ = 'Ricardo Jurado'
__copyright__ = 'Ricardo Jurado'
__version__ = 'v0.3'
__date__ = '06 February 2011'

'''
http://www.abc.es/
'''


class AdvancedUserRecipe1296604369(BasicNewsRecipe):

title = u'ABC.es'
publisher = u'Grupo VOCENTO'

__author__ = 'Ricardo Jurado'
description = 'Noticias de Spain y el mundo'

title = u'ABC.es'
oldest_article = 1
max_articles_per_feed = 5
no_stylesheets = True
use_embedded_content = False
encoding = 'ISO-8859-1'
remove_javascript = True
language = 'es'

extra_css = """
p{text-align: justify; font-size: 100%}
body{ text-align: left; font-size:100% }
h3{font-family: sans-serif; font-size:120%; font-weight:bold; text-align: justify; }
h2{font-family: sans-serif; font-size:100%; font-weight:bold; text-align: justify; }
h1{font-family: sans-serif; font-size:150%; font-weight:bold; text-align: justify; }
"""

keep_only_tags = [
# dict(name='h2', attrs={'class':['logos']}),
dict(name='h3', attrs={'class':['overhead']}),
dict(name='h1', attrs={'class':'headline'}),
dict(name='h3', attrs={'class':['subhead']}),
dict(name='div', attrs={'class':'datosi'}),
dict(name='div', attrs={'class':'photo-alt1'}),
dict(name='div', attrs={'class':'text'})
]

# remove_tags_before = dict(name='div' , attrs={'id':['cabecera2']})

feeds = [
(u'PORTADA', u'http://www.abc.es/rss/feeds/abcPortada.xml')
,(u'ULTIMAS', u'http://www.abc.es/rss/feeds/abc_ultima.xml')
,(u'NACIONAL', u'http://www.abc.es/rss/feeds/abc_EspanaEspana.xml')
,(u'INTERNACIONAL', u'http://www.abc.es/rss/feeds/abc_Internacional.xml')
,(u'OPINION', u'http://www.abc.es/rss/feeds/abc_opinioncompleto.xml')
,(u'ECONOMIA', u'http://www.abc.es/rss/feeds/abc_Economia.xml')
,(u'CIENCIA Y TECNOLOGIA', u'http://www.abc.es/rss/feeds/abc_Ciencia_Tecnologia.xml')
,(u'CULTURA', u'http://www.abc.es/rss/feeds/abc_Cultura.xml')
,(u'LIBROS', u'http://www.abc.es/rss/feeds/abc_Libros.xml')
,(u'ESPECTACULOS', u'http://www.abc.es/rss/feeds/abc_Espectaculos.xml')
,(u'DEPORTES', u'http://www.abc.es/rss/feeds/abc_Deportes.xml')
]

tolyluis
06/02/2011, 22:20
Luego le echo un vistazo ;)

KRorschachZ
09/02/2011, 18:21
Poquito a poco...


__license__ = 'GPL v3'
__author__ = 'Ricardo Jurado'
__copyright__ = 'Ricardo Jurado'
__version__ = 'v0.3'
__date__ = '06 February 2011'

'''
http://www.abc.es/
'''


class AdvancedUserRecipe1296604369(BasicNewsRecipe):

title = u'ABC.es'
publisher = u'Grupo VOCENTO'

__author__ = 'Ricardo Jurado'
description = 'Noticias de Spain y el mundo'

title = u'ABC.es'
oldest_article = 1
max_articles_per_feed = 5
no_stylesheets = True
use_embedded_content = False
encoding = 'ISO-8859-1'
remove_javascript = True
language = 'es'

extra_css = """
p{text-align: justify; font-size: 100%}
body{ text-align: left; font-size:100% }
h3{font-family: sans-serif; font-size:120%; font-weight:bold; text-align: justify; }
h2{font-family: sans-serif; font-size:100%; font-weight:bold; text-align: justify; }
h1{font-family: sans-serif; font-size:150%; font-weight:bold; text-align: justify; }
"""

keep_only_tags = [
# dict(name='h2', attrs={'class':['logos']}),
dict(name='h3', attrs={'class':['overhead']}),
dict(name='h1', attrs={'class':'headline'}),
dict(name='h3', attrs={'class':['subhead']}),
dict(name='div', attrs={'class':'datosi'}),
dict(name='div', attrs={'class':'photo-alt1'}),
dict(name='div', attrs={'class':'text'})
]

# remove_tags_before = dict(name='div' , attrs={'id':['cabecera2']})

feeds = [
(u'PORTADA', u'http://www.abc.es/rss/feeds/abcPortada.xml')
,(u'ULTIMAS', u'http://www.abc.es/rss/feeds/abc_ultima.xml')
,(u'NACIONAL', u'http://www.abc.es/rss/feeds/abc_EspanaEspana.xml')
,(u'INTERNACIONAL', u'http://www.abc.es/rss/feeds/abc_Internacional.xml')
,(u'OPINION', u'http://www.abc.es/rss/feeds/abc_opinioncompleto.xml')
,(u'ECONOMIA', u'http://www.abc.es/rss/feeds/abc_Economia.xml')
,(u'CIENCIA Y TECNOLOGIA', u'http://www.abc.es/rss/feeds/abc_Ciencia_Tecnologia.xml')
,(u'CULTURA', u'http://www.abc.es/rss/feeds/abc_Cultura.xml')
,(u'LIBROS', u'http://www.abc.es/rss/feeds/abc_Libros.xml')
,(u'ESPECTACULOS', u'http://www.abc.es/rss/feeds/abc_Espectaculos.xml')
,(u'DEPORTES', u'http://www.abc.es/rss/feeds/abc_Deportes.xml')
]




OK ¡ pues muchas gracias por una RECATA DE ABC.es Que si que funciona :D...

un enorme saludo. ¡

rickydh
11/02/2011, 16:29
Hola.

Me alegra que te sirva.

Aquí van algunos feeds más y el gif de la portada.
Lo voy a postear en mobileread a ver si lo meten en la próxima versión de Calibre


__license__ = 'GPL v3'
__author__ = 'Ricardo Jurado'
__copyright__ = 'Ricardo Jurado'
__version__ = 'v0.4'
__date__ = '11 February 2011'

'''
http://www.abc.es/
'''


class AdvancedUserRecipe1296604369(BasicNewsRecipe):

title = u'ABC.es'
masthead_url = 'http://www.abc.es/img/logo-abc.gif'
cover_url = 'http://www.abc.es/img/logo-abc.gif'
publisher = u'Grupo VOCENTO'

__author__ = 'Ricardo Jurado'
description = 'Noticias de Spain y el mundo'
category = 'News,Spain,National,International,Economy'
oldest_article = 2
max_articles_per_feed = 10

no_stylesheets = True
use_embedded_content = False
encoding = 'ISO-8859-1'
remove_javascript = True
language = 'es'

extra_css = """
p{text-align: justify; font-size: 100%}
body{ text-align: left; font-size:100% }
h3{font-family: sans-serif; font-size:120%; font-weight:bold; text-align: justify; }
h2{font-family: sans-serif; font-size:100%; font-weight:bold; text-align: justify; }
h1{font-family: sans-serif; font-size:150%; font-weight:bold; text-align: justify; }
"""

keep_only_tags = [
# dict(name='h2', attrs={'class':['logos']}),
dict(name='h3', attrs={'class':['overhead']}),
dict(name='h1', attrs={'class':'headline'}),
dict(name='h3', attrs={'class':['subhead']}),
dict(name='div', attrs={'class':'datosi'}),
dict(name='div', attrs={'class':'photo-alt1'}),
dict(name='div', attrs={'class':'text'})
]

# remove_tags_before = dict(name='div' , attrs={'id':['cabecera2']})

feeds = [
(u'PORTADA', u'http://www.abc.es/rss/feeds/abcPortada.xml')
,(u'ULTIMAS', u'http://www.abc.es/rss/feeds/abc_ultima.xml')
,(u'NACIONAL', u'http://www.abc.es/rss/feeds/abc_EspanaEspana.xml')
,(u'INTERNACIONAL', u'http://www.abc.es/rss/feeds/abc_Internacional.xml')
,(u'OPINION', u'http://www.abc.es/rss/feeds/abc_opinioncompleto.xml')
,(u'BLOGS ABC', u'http://www.abc.es/rss/feeds/blogs-abc.xml')
,(u'ECONOMIA', u'http://www.abc.es/rss/feeds/abc_Economia.xml')
,(u'CIENCIA Y TECNOLOGIA', u'http://www.abc.es/rss/feeds/abc_Ciencia_Tecnologia.xml')
,(u'CULTURA', u'http://www.abc.es/rss/feeds/abc_Cultura.xml')
,(u'LIBROS', u'http://www.abc.es/rss/feeds/abc_Libros.xml')
,(u'MEDIOS Y REDES', u'http://www.abc.es/rss/feeds/ABC_Medios_Redes.xml')
,(u'EVASION', u'http://www.abc.es/rss/feeds/abc_evasion.xml')
,(u'ESPECTACULOS', u'http://www.abc.es/rss/feeds/abc_Espectaculos.xml')
,(u'GENTE', u'http://www.abc.es/rss/feeds/abc_Gente.xml')
,(u'DEPORTES', u'http://www.abc.es/rss/feeds/abc_Deportes.xml')
]


--
Saludos

KRorschachZ
12/02/2011, 00:50
Hola.

Me alegra que te sirva.

Aquí van algunos feeds más y el gif de la portada.
Lo voy a postear en mobileread a ver si lo meten en la próxima versión de Calibre


__license__ = 'GPL v3'
__author__ = 'Ricardo Jurado'
__copyright__ = 'Ricardo Jurado'
__version__ = 'v0.4'
__date__ = '11 February 2011'

'''
http://www.abc.es/
'''


class AdvancedUserRecipe1296604369(BasicNewsRecipe):

title = u'ABC.es'
masthead_url = 'http://www.abc.es/img/logo-abc.gif'
cover_url = 'http://www.abc.es/img/logo-abc.gif'
publisher = u'Grupo VOCENTO'

__author__ = 'Ricardo Jurado'
description = 'Noticias de Spain y el mundo'
category = 'News,Spain,National,International,Economy'
oldest_article = 2
max_articles_per_feed = 10

no_stylesheets = True
use_embedded_content = False
encoding = 'ISO-8859-1'
remove_javascript = True
language = 'es'

extra_css = """
p{text-align: justify; font-size: 100%}
body{ text-align: left; font-size:100% }
h3{font-family: sans-serif; font-size:120%; font-weight:bold; text-align: justify; }
h2{font-family: sans-serif; font-size:100%; font-weight:bold; text-align: justify; }
h1{font-family: sans-serif; font-size:150%; font-weight:bold; text-align: justify; }
"""

keep_only_tags = [
# dict(name='h2', attrs={'class':['logos']}),
dict(name='h3', attrs={'class':['overhead']}),
dict(name='h1', attrs={'class':'headline'}),
dict(name='h3', attrs={'class':['subhead']}),
dict(name='div', attrs={'class':'datosi'}),
dict(name='div', attrs={'class':'photo-alt1'}),
dict(name='div', attrs={'class':'text'})
]

# remove_tags_before = dict(name='div' , attrs={'id':['cabecera2']})

feeds = [
(u'PORTADA', u'http://www.abc.es/rss/feeds/abcPortada.xml')
,(u'ULTIMAS', u'http://www.abc.es/rss/feeds/abc_ultima.xml')
,(u'NACIONAL', u'http://www.abc.es/rss/feeds/abc_EspanaEspana.xml')
,(u'INTERNACIONAL', u'http://www.abc.es/rss/feeds/abc_Internacional.xml')
,(u'OPINION', u'http://www.abc.es/rss/feeds/abc_opinioncompleto.xml')
,(u'BLOGS ABC', u'http://www.abc.es/rss/feeds/blogs-abc.xml')
,(u'ECONOMIA', u'http://www.abc.es/rss/feeds/abc_Economia.xml')
,(u'CIENCIA Y TECNOLOGIA', u'http://www.abc.es/rss/feeds/abc_Ciencia_Tecnologia.xml')
,(u'CULTURA', u'http://www.abc.es/rss/feeds/abc_Cultura.xml')
,(u'LIBROS', u'http://www.abc.es/rss/feeds/abc_Libros.xml')
,(u'MEDIOS Y REDES', u'http://www.abc.es/rss/feeds/ABC_Medios_Redes.xml')
,(u'EVASION', u'http://www.abc.es/rss/feeds/abc_evasion.xml')
,(u'ESPECTACULOS', u'http://www.abc.es/rss/feeds/abc_Espectaculos.xml')
,(u'GENTE', u'http://www.abc.es/rss/feeds/abc_Gente.xml')
,(u'DEPORTES', u'http://www.abc.es/rss/feeds/abc_Deportes.xml')
]


--
Saludos

a ver. a ver... habrá que cargarla...

un saludo. ;-9

Lagarto
12/02/2011, 01:15
Gracias por la receta, ya la estoy usando en el calibre =D>