elonet.py 2.5 KB

12345678910111213141516171819202122232425262728293031323334353637383940414243444546474849505152535455565758596061626364
  1. from .common import InfoExtractor
  2. from ..utils import determine_ext
  3. class ElonetIE(InfoExtractor):
  4. _VALID_URL = r'https?://elonet\.finna\.fi/Record/kavi\.elonet_elokuva_(?P<id>[0-9]+)'
  5. _TESTS = [{
  6. 'url': 'https://elonet.finna.fi/Record/kavi.elonet_elokuva_107867',
  7. 'info_dict': {
  8. 'id': '107867',
  9. 'ext': 'mp4',
  10. 'title': 'Valkoinen peura',
  11. 'thumbnail': r're:^https?://elonet\.finna\.fi/Cover/Show\?id=kavi\.elonet_elokuva_107867.+',
  12. 'description': 'md5:bded4201c9677fab10854884fe8f7312',
  13. },
  14. 'params': {'skip_download': 'dash'},
  15. }, {
  16. # DASH with subtitles
  17. 'url': 'https://elonet.finna.fi/Record/kavi.elonet_elokuva_116539',
  18. 'info_dict': {
  19. 'id': '116539',
  20. 'ext': 'mp4',
  21. 'title': 'Minulla on tiikeri',
  22. 'thumbnail': r're:^https?://elonet\.finna\.fi/Cover/Show\?id=kavi\.elonet_elokuva_116539.+',
  23. 'description': 'md5:5ab72b3fe76d3414e46cc8f277104419',
  24. },
  25. 'params': {'skip_download': 'dash'},
  26. }, {
  27. # Page with multiple videos, download the main one
  28. 'url': 'https://elonet.finna.fi/Record/kavi.elonet_elokuva_117396',
  29. 'info_dict': {
  30. 'id': '117396',
  31. 'ext': 'mp4',
  32. 'title': 'Sampo',
  33. 'thumbnail': r're:^https?://elonet\.finna\.fi/Cover/Show\?id=kavi\.elonet_elokuva_117396.+',
  34. 'description': 'md5:ec69572a5b054d0ecafe8086b1fa96f7',
  35. },
  36. 'params': {'skip_download': 'dash'},
  37. }]
  38. def _real_extract(self, url):
  39. video_id = self._match_id(url)
  40. webpage = self._download_webpage(url, video_id)
  41. src = self._parse_json(self._html_search_regex(
  42. r'id=\'video-data\'[^>]+data-video-sources="([^"]+)"', webpage, 'json'), video_id)[0]['src']
  43. ext = determine_ext(src)
  44. if ext == 'm3u8':
  45. formats, subtitles = self._extract_m3u8_formats_and_subtitles(src, video_id, fatal=False)
  46. elif ext == 'mpd':
  47. formats, subtitles = self._extract_mpd_formats_and_subtitles(src, video_id, fatal=False)
  48. else:
  49. formats, subtitles = [], {}
  50. self.raise_no_formats(f'Unknown streaming format {ext}')
  51. return {
  52. 'id': video_id,
  53. 'title': self._og_search_title(webpage),
  54. 'description': self._og_search_description(webpage),
  55. 'thumbnail': self._og_search_thumbnail(webpage),
  56. 'formats': formats,
  57. 'subtitles': subtitles,
  58. }