PDA

Ver la versión completa : Europa Press (v1.0)



tolyluis
06/02/2011, 22:28
Hola buenasss

Hice estos días atras esta receta de la web de

Europa Press - http://www.europapress.es/

NOTAS

He cogido todos los feeds de las "Secciones Principales" EXCEPTO el de EP Social. También he descartado los feeds autonómicos y en lenguas cooficiales y los del apartado "innovación". De momento es lo que he podido sacar en claro.

CODIGO FUENTE



__license__ = 'GPL v3'
__author__ = 'Luis Hernandez'
__copyright__ = 'Luis Hernandez<tolyluis@gmail.com>'
__version__ = 'v1.0'
__date__ = '30 January 2011'

'''
www.europapress.es
'''

class AdvancedUserRecipe1294946868(BasicNewsRecipe):

title = u'Europa Press'
author = 'Luis Hernandez'
description = 'spanish news agency'

oldest_article = 2
max_articles_per_feed = 100

remove_javascript = True
no_stylesheets = True
use_embedded_content = False

language = 'es'
timefmt = '[%a, %d %b, %Y]'

remove_tags_before = dict(name='div' , attrs={'class':['nivel1 bg_3col']})
remove_tags_after = dict(name='div' , attrs={'id':['ImprimirEnviarNoticia']})

remove_tags = [
dict(name='ul', attrs={'id':['entidadesNoticia','MenuSecciones']})
,dict(name='div', attrs={'id':['ImprimirEnviarNoticia','PublicidadSuperior','Cabe ceraDerecha','Comentarios','comentarios full fbConnectAPI','ComentarEstaNoticia','ctl00_Superio r_Main_MasEnChance_cajamasnoticias','gl_chn','vide os_portada_derecha','galeria_portada_central','gal eria_portada_central_boxes']})
,dict(name='div', attrs={'class':['infoRelacionada','col_1','buscador','caja doblecolumna strong','CHANCE_EP_Encuesta_frontal text','seccionportada col_0','seccion header','text','pie caption_over']})
,dict(name='a', attrs={'class':['buscadorLabel']})
,dict(name='span', attrs={'class':['editado']})
,dict(name='table')
,dict(name='li')
]


feeds = [
(u'Portada' , u'http://www.europapress.es/rss/rss.aspx')
,(u'Nacional' , u'http://www.europapress.es/rss/rss.aspx?ch=66')
,(u'Internacional' , u'http://www.europapress.es/rss/rss.aspx?ch=69')
,(u'Economia' , u'http://www.europapress.es/rss/rss.aspx?ch=136')
,(u'Deportes' , u'http://www.europapress.es/rss/rss.aspx?ch=67')
,(u'Cultura' , u'http://www.europapress.es/rss/rss.aspx?ch=126')
,(u'Sociedad' , u'http://www.europapress.es/rss/rss.aspx?ch=73')
,(u'Motor' , u'http://www.europapress.es/rss/rss.aspx?ch=435')
,(u'CHANCE' , u'http://www.europapress.es/rss/rss.aspx?ch=549')
,(u'Comunicados' , u'http://www.europapress.es/rss/rss.aspx?ch=137')
]


Ya me diréis (si os apetece) que os parece...

rickydh
07/02/2011, 08:02
Buenas.

Funciona muy bien, por lo menos en Calibre :-)

--
Saludos.

KRorschachZ
09/02/2011, 18:20
Hola buenasss

Hice estos días atras esta receta de la web de

Europa Press - http://www.europapress.es/

NOTAS

He cogido todos los feeds de las "Secciones Principales" EXCEPTO el de EP Social. También he descartado los feeds autonómicos y en lenguas cooficiales y los del apartado "innovación". De momento es lo que he podido sacar en claro.

CODIGO FUENTE



__license__ = 'GPL v3'
__author__ = 'Luis Hernandez'
__copyright__ = 'Luis Hernandez<tolyluis@gmail.com>'
__version__ = 'v1.0'
__date__ = '30 January 2011'

'''
www.europapress.es
'''

class AdvancedUserRecipe1294946868(BasicNewsRecipe):

title = u'Europa Press'
author = 'Luis Hernandez'
description = 'spanish news agency'

oldest_article = 2
max_articles_per_feed = 100

remove_javascript = True
no_stylesheets = True
use_embedded_content = False

language = 'es'
timefmt = '[%a, %d %b, %Y]'

remove_tags_before = dict(name='div' , attrs={'class':['nivel1 bg_3col']})
remove_tags_after = dict(name='div' , attrs={'id':['ImprimirEnviarNoticia']})

remove_tags = [
dict(name='ul', attrs={'id':['entidadesNoticia','MenuSecciones']})
,dict(name='div', attrs={'id':['ImprimirEnviarNoticia','PublicidadSuperior','Cabe ceraDerecha','Comentarios','comentarios full fbConnectAPI','ComentarEstaNoticia','ctl00_Superio r_Main_MasEnChance_cajamasnoticias','gl_chn','vide os_portada_derecha','galeria_portada_central','gal eria_portada_central_boxes']})
,dict(name='div', attrs={'class':['infoRelacionada','col_1','buscador','caja doblecolumna strong','CHANCE_EP_Encuesta_frontal text','seccionportada col_0','seccion header','text','pie caption_over']})
,dict(name='a', attrs={'class':['buscadorLabel']})
,dict(name='span', attrs={'class':['editado']})
,dict(name='table')
,dict(name='li')
]


feeds = [
(u'Portada' , u'http://www.europapress.es/rss/rss.aspx')
,(u'Nacional' , u'http://www.europapress.es/rss/rss.aspx?ch=66')
,(u'Internacional' , u'http://www.europapress.es/rss/rss.aspx?ch=69')
,(u'Economia' , u'http://www.europapress.es/rss/rss.aspx?ch=136')
,(u'Deportes' , u'http://www.europapress.es/rss/rss.aspx?ch=67')
,(u'Cultura' , u'http://www.europapress.es/rss/rss.aspx?ch=126')
,(u'Sociedad' , u'http://www.europapress.es/rss/rss.aspx?ch=73')
,(u'Motor' , u'http://www.europapress.es/rss/rss.aspx?ch=435')
,(u'CHANCE' , u'http://www.europapress.es/rss/rss.aspx?ch=549')
,(u'Comunicados' , u'http://www.europapress.es/rss/rss.aspx?ch=137')
]


Ya me diréis (si os apetece) que os parece...

Pues mola mazo. gracias, muy chula. ;-)