mirror of https://github.com/yt-dlp/yt-dlp.git
[laola1tv] add support embed urls and improve extraction(#11460)
This commit is contained in:
parent
6e416b210c
commit
b42a0bf360
|
@ -446,7 +446,10 @@ from .kuwo import (
|
||||||
KuwoMvIE,
|
KuwoMvIE,
|
||||||
)
|
)
|
||||||
from .la7 import LA7IE
|
from .la7 import LA7IE
|
||||||
from .laola1tv import Laola1TvIE
|
from .laola1tv import (
|
||||||
|
Laola1TvEmbedIE,
|
||||||
|
Laola1TvIE,
|
||||||
|
)
|
||||||
from .lci import LCIIE
|
from .lci import LCIIE
|
||||||
from .lcp import (
|
from .lcp import (
|
||||||
LcpPlayIE,
|
LcpPlayIE,
|
||||||
|
|
|
@ -1,25 +1,81 @@
|
||||||
# coding: utf-8
|
# coding: utf-8
|
||||||
from __future__ import unicode_literals
|
from __future__ import unicode_literals
|
||||||
|
|
||||||
import re
|
|
||||||
|
|
||||||
from .common import InfoExtractor
|
from .common import InfoExtractor
|
||||||
from ..compat import (
|
|
||||||
compat_urllib_parse_urlencode,
|
|
||||||
compat_urlparse,
|
|
||||||
)
|
|
||||||
from ..utils import (
|
from ..utils import (
|
||||||
ExtractorError,
|
ExtractorError,
|
||||||
sanitized_Request,
|
|
||||||
unified_strdate,
|
unified_strdate,
|
||||||
urlencode_postdata,
|
urlencode_postdata,
|
||||||
xpath_element,
|
xpath_element,
|
||||||
xpath_text,
|
xpath_text,
|
||||||
|
urljoin,
|
||||||
)
|
)
|
||||||
|
|
||||||
|
|
||||||
|
class Laola1TvEmbedIE(InfoExtractor):
|
||||||
|
_VALID_URL = r'https?://(?:www\.)?laola1\.tv/titanplayer\.php\?.*?\bvideoid=(?P<id>\d+)'
|
||||||
|
|
||||||
|
def _real_extract(self, url):
|
||||||
|
video_id = self._match_id(url)
|
||||||
|
webpage = self._download_webpage(url, video_id)
|
||||||
|
flash_vars = self._search_regex(
|
||||||
|
r'(?s)flashvars\s*=\s*({.+?});', webpage, 'flash vars')
|
||||||
|
get_flashvar = lambda x: self._search_regex(r'%s\s*:\s*"([^"]+)"' % x, flash_vars, x)
|
||||||
|
|
||||||
|
hd_doc = self._download_xml(
|
||||||
|
'http://www.laola1.tv/server/hd_video.php', video_id, query={
|
||||||
|
'play': get_flashvar('streamid'),
|
||||||
|
'partner': get_flashvar('partnerid'),
|
||||||
|
'portal': get_flashvar('portalid'),
|
||||||
|
'lang': get_flashvar('sprache'),
|
||||||
|
'v5ident': '',
|
||||||
|
})
|
||||||
|
|
||||||
|
_v = lambda x, **k: xpath_text(hd_doc, './/video/' + x, **k)
|
||||||
|
title = _v('title', fatal=True)
|
||||||
|
|
||||||
|
data_abo = urlencode_postdata(
|
||||||
|
dict((i, v) for i, v in enumerate(_v('req_liga_abos').split(','))))
|
||||||
|
token_url = self._download_json(
|
||||||
|
'https://club.laola1.tv/sp/laola1/api/v3/user/session/premium/player/stream-access',
|
||||||
|
video_id, query={
|
||||||
|
'videoId': _v('id'),
|
||||||
|
'target': self._search_regex(r'vs_target = (\d+);', webpage, 'vs target'),
|
||||||
|
'label': _v('label'),
|
||||||
|
'area': _v('area'),
|
||||||
|
}, data=data_abo)['data']['stream-access'][0]
|
||||||
|
token_doc = self._download_xml(
|
||||||
|
token_url, video_id, 'Downloading token',
|
||||||
|
headers=self.geo_verification_headers())
|
||||||
|
|
||||||
|
token_attrib = xpath_element(token_doc, './/token').attrib
|
||||||
|
|
||||||
|
if token_attrib['status'] != '0':
|
||||||
|
raise ExtractorError(
|
||||||
|
'Token error: %s' % token_attrib['comment'], expected=True)
|
||||||
|
|
||||||
|
formats = self._extract_akamai_formats(
|
||||||
|
'%s?hdnea=%s' % (token_attrib['url'], token_attrib['auth']),
|
||||||
|
video_id)
|
||||||
|
self._sort_formats(formats)
|
||||||
|
|
||||||
|
categories_str = _v('meta_sports')
|
||||||
|
categories = categories_str.split(',') if categories_str else []
|
||||||
|
is_live = _v('islive') == 'true'
|
||||||
|
|
||||||
|
return {
|
||||||
|
'id': video_id,
|
||||||
|
'title': self._live_title(title) if is_live else title,
|
||||||
|
'upload_date': unified_strdate(_v('time_date')),
|
||||||
|
'uploader': _v('meta_organisation'),
|
||||||
|
'categories': categories,
|
||||||
|
'is_live': is_live,
|
||||||
|
'formats': formats,
|
||||||
|
}
|
||||||
|
|
||||||
|
|
||||||
class Laola1TvIE(InfoExtractor):
|
class Laola1TvIE(InfoExtractor):
|
||||||
_VALID_URL = r'https?://(?:www\.)?laola1\.tv/(?P<lang>[a-z]+)-(?P<portal>[a-z]+)/(?P<kind>[^/]+)/(?P<slug>[^/?#&]+)'
|
_VALID_URL = r'https?://(?:www\.)?laola1\.tv/[a-z]+-[a-z]+/[^/]+/(?P<id>[^/?#&]+)'
|
||||||
_TESTS = [{
|
_TESTS = [{
|
||||||
'url': 'http://www.laola1.tv/de-de/video/straubing-tigers-koelner-haie/227883.html',
|
'url': 'http://www.laola1.tv/de-de/video/straubing-tigers-koelner-haie/227883.html',
|
||||||
'info_dict': {
|
'info_dict': {
|
||||||
|
@ -67,85 +123,20 @@ class Laola1TvIE(InfoExtractor):
|
||||||
}]
|
}]
|
||||||
|
|
||||||
def _real_extract(self, url):
|
def _real_extract(self, url):
|
||||||
mobj = re.match(self._VALID_URL, url)
|
display_id = self._match_id(url)
|
||||||
display_id = mobj.group('slug')
|
|
||||||
kind = mobj.group('kind')
|
|
||||||
lang = mobj.group('lang')
|
|
||||||
portal = mobj.group('portal')
|
|
||||||
|
|
||||||
webpage = self._download_webpage(url, display_id)
|
webpage = self._download_webpage(url, display_id)
|
||||||
|
|
||||||
if 'Dieser Livestream ist bereits beendet.' in webpage:
|
if 'Dieser Livestream ist bereits beendet.' in webpage:
|
||||||
raise ExtractorError('This live stream has already finished.', expected=True)
|
raise ExtractorError('This live stream has already finished.', expected=True)
|
||||||
|
|
||||||
iframe_url = self._search_regex(
|
iframe_url = urljoin(url, self._search_regex(
|
||||||
r'<iframe[^>]*?id="videoplayer"[^>]*?src="([^"]+)"',
|
r'<iframe[^>]*?id="videoplayer"[^>]*?src="([^"]+)"',
|
||||||
webpage, 'iframe url')
|
webpage, 'iframe url'))
|
||||||
|
|
||||||
video_id = self._search_regex(
|
|
||||||
r'videoid=(\d+)', iframe_url, 'video id')
|
|
||||||
|
|
||||||
iframe = self._download_webpage(compat_urlparse.urljoin(
|
|
||||||
url, iframe_url), display_id, 'Downloading iframe')
|
|
||||||
|
|
||||||
partner_id = self._search_regex(
|
|
||||||
r'partnerid\s*:\s*(["\'])(?P<partner_id>.+?)\1',
|
|
||||||
iframe, 'partner id', group='partner_id')
|
|
||||||
|
|
||||||
hd_doc = self._download_xml(
|
|
||||||
'http://www.laola1.tv/server/hd_video.php?%s'
|
|
||||||
% compat_urllib_parse_urlencode({
|
|
||||||
'play': video_id,
|
|
||||||
'partner': partner_id,
|
|
||||||
'portal': portal,
|
|
||||||
'lang': lang,
|
|
||||||
'v5ident': '',
|
|
||||||
}), display_id)
|
|
||||||
|
|
||||||
_v = lambda x, **k: xpath_text(hd_doc, './/video/' + x, **k)
|
|
||||||
title = _v('title', fatal=True)
|
|
||||||
|
|
||||||
VS_TARGETS = {
|
|
||||||
'video': '2',
|
|
||||||
'livestream': '17',
|
|
||||||
}
|
|
||||||
|
|
||||||
req = sanitized_Request(
|
|
||||||
'https://club.laola1.tv/sp/laola1/api/v3/user/session/premium/player/stream-access?%s' %
|
|
||||||
compat_urllib_parse_urlencode({
|
|
||||||
'videoId': video_id,
|
|
||||||
'target': VS_TARGETS.get(kind, '2'),
|
|
||||||
'label': _v('label'),
|
|
||||||
'area': _v('area'),
|
|
||||||
}),
|
|
||||||
urlencode_postdata(
|
|
||||||
dict((i, v) for i, v in enumerate(_v('req_liga_abos').split(',')))))
|
|
||||||
|
|
||||||
token_url = self._download_json(req, display_id)['data']['stream-access'][0]
|
|
||||||
token_doc = self._download_xml(token_url, display_id, 'Downloading token')
|
|
||||||
|
|
||||||
token_attrib = xpath_element(token_doc, './/token').attrib
|
|
||||||
token_auth = token_attrib['auth']
|
|
||||||
|
|
||||||
if token_auth in ('blocked', 'restricted', 'error'):
|
|
||||||
raise ExtractorError(
|
|
||||||
'Token error: %s' % token_attrib['comment'], expected=True)
|
|
||||||
|
|
||||||
formats = self._extract_f4m_formats(
|
|
||||||
'%s?hdnea=%s&hdcore=3.2.0' % (token_attrib['url'], token_auth),
|
|
||||||
video_id, f4m_id='hds')
|
|
||||||
self._sort_formats(formats)
|
|
||||||
|
|
||||||
categories_str = _v('meta_sports')
|
|
||||||
categories = categories_str.split(',') if categories_str else []
|
|
||||||
|
|
||||||
return {
|
return {
|
||||||
'id': video_id,
|
'_type': 'url',
|
||||||
'display_id': display_id,
|
'display_id': display_id,
|
||||||
'title': title,
|
'url': iframe_url,
|
||||||
'upload_date': unified_strdate(_v('time_date')),
|
'ie_key': 'Laola1TvEmbed',
|
||||||
'uploader': _v('meta_organisation'),
|
|
||||||
'categories': categories,
|
|
||||||
'is_live': _v('islive') == 'true',
|
|
||||||
'formats': formats,
|
|
||||||
}
|
}
|
||||||
|
|
Loading…
Reference in New Issue