]>
Raphaël G. Git Repositories - youtubedl/blob - youtube_dl/extractor/tvp.py 
cc26f417a0c208efd946aa91c72086471d69ccaa
   1  # -*- coding: utf-8 -*-    2  from  __future__ 
import  unicode_literals
   6  from  . common 
import  InfoExtractor
   9  class  TvpIE ( InfoExtractor
):   11      _VALID_URL 
=  r
'https?://(?:vod|www)\.tvp\.pl/.*/(?P<id>\d+)$'   14          'url' :  'http://vod.tvp.pl/filmy-fabularne/filmy-za-darmo/ogniem-i-mieczem/wideo/odc-2/4278035' ,   18              'title' :  'Ogniem i mieczem, odc. 2' ,   19              'description' :  'Bohun dowiaduje się o złamaniu przez kniahinię danego mu słowa i wyrusza do Rozłogów. Helenie w ostatniej chwili udaje się uciec dzięki pomocy Zagłoby.' ,   22          'url' :  'http://vod.tvp.pl/seriale/obyczajowe/czas-honoru/sezon-1-1-13/i-seria-odc-13/194536' ,   26              'title' :  'Czas honoru, I seria – odc. 13' ,   27              #  'description': 'WŁADEK\nCzesław prosi Marię o dostarczenie Władkowi zarazki tyfusu. Jeśli zachoruje zostanie przewieziony do szpitala skąd łatwiej będzie go odbić. Czy matka zdecyduje się zarazić syna? Karol odwiedza Wandę przyznaje się, że ją oszukiwał, ale ostrzega też, że grozi jej aresztowanie i nalega, żeby wyjechała z Warszawy. Czy dziewczyna zdecyduje się znów oddalić od ukochanego? Rozpoczyna się akcja odbicia Władka.',   30          'url' :  'http://www.tvp.pl/there-can-be-anything-so-i-shortened-it/17916176' ,   34              'title' :  'TVP Gorzów pokaże filmy studentów z podroży dookoła świata' ,   38              'skip_download' :  'true' ,   41          'url' :  'http://vod.tvp.pl/seriale/obyczajowe/na-sygnale/sezon-2-27-/odc-39/17834272' ,   45              'title' :  'Na sygnale, odc. 39' ,   46              'description' :  'Ekipa Wiktora ratuje młodą matkę, która spadła ze schodów trzymając na rękach noworodka. Okazuje się, że dziewczyna jest surogatką, a biologiczni rodzice dziecka próbują zmusić ją do oddania synka…' ,   50              'skip_download' :  'true' ,   54      def  _real_extract ( self
,  url
):   55          video_id 
=  self
._ match
_ id
( url
)   56          webpage 
=  self
._ download
_ webpage
(   57              'http://www.tvp.pl/sess/tvplayer.php?object_id= %s '  %  video_id
,  video_id
)   59          title 
=  self
._ og
_ search
_ title
( webpage
)   60          series 
=  self
._ search
_ regex
(   61              r
'{name:\s*([\' "])SeriesTitle\1,\s*value:\s*\1(?P<series>.*?)\1},',   62              webpage, 'series', group='series', default=None)   63          if series is not None and series not in title:   64              title = ' %s ,  %s ' % (series, title)   65          description = self._og_search_description(webpage, default=None)   67          video_url = self._search_regex(   68              r'0:{src:([ \' " ])( ?P
< url
>.* ?
) \
1 ', webpage, ' formats
', group=' url
', default=None)   70              video_url = self._download_json(   71                  ' http
:// www
. tvp
. pl
/ pub
/ stat
/ videofileinfo?video_id
= %s ' % video_id,   72                  video_id)[' video_url
']   74          ext = video_url.rsplit(' . ', 1)[-1]   75          if ext != ' ism
/ manifest
':   79                  ' format_id
': ' direct
',   84              m3u8_url = re.sub(' ([ ^
/]*) \
. ism
/ manifest
', r' \
1 . ism
/ \
1 . m3u8
', video_url)   85              formats = self._extract_m3u8_formats(m3u8_url, video_id, ' mp4
')   87          self._sort_formats(formats)   92              ' thumbnail
': self._og_search_thumbnail(webpage),   93              ' description
': description,   98  class TvpSeriesIE(InfoExtractor):   99      IE_NAME = ' tvp
. pl
: Series
'  100      _VALID_URL = r' https?
:// vod\
. tvp\
. pl
/( ?
:[ ^
/]+/) {2}
( ?P
< id >[ ^
/]+)/ ?$
'  103          ' url
': ' http
:// vod
. tvp
. pl
/ filmy
- fabularne
/ filmy
- za
- darmo
/ ogniem
- i
- mieczem
',  105              ' title
': ' Ogniem i mieczem
',  110          ' url
': ' http
:// vod
. tvp
. pl
/ audycje
/ podroze
/ boso
- przez
- swiat
',  112              ' title
': ' Boso przez świat
',  115          ' playlist_count
': 86,  118      def _real_extract(self, url):  119          display_id = self._match_id(url)  120          webpage = self._download_webpage(url, display_id, tries=5)  122          title = self._html_search_regex(  123              r' ( ?s
)  id =[ \' "]path[ \' " ]>( ?
:.* ? 
/ ) {2}
(.* ?
)</ span
> ', webpage, ' series
')  124          playlist_id = self._search_regex(r' nodeId
: \s
*( \d
+) ', webpage, ' playlist 
id ')  125          playlist = self._download_webpage(  126              ' http
:// vod
. tvp
. pl
/ vod
/ seriesAjax?
type = series
& nodeId
= %s& recommend
'  127              ' edId
= 0 & sort
=& page
= 0 & pageSize
= 10000 ' % playlist_id, display_id, tries=5,  128              note=' Downloading playlist
')  130          videos_paths = re.findall(  131              ' ( ?s
) class = "shortTitle" >.* ?href
= "(/[^" ]+) ', playlist)  133              self.url_result(' http
:// vod
. tvp
. pl
%s ' % v_path, ie=TvpIE.ie_key())  134              for v_path in videos_paths]  139              ' display_id
': display_id,