youtube-dl/youtube_dl/extractor/godtube.py

from __future__ import unicode_literals

import re

from .common import InfoExtractor
from ..utils import (
    parse_duration,
    parse_iso8601,
)


class GodTubeIE(InfoExtractor):
    _VALID_URL = r'https?://(?:www\.)?godtube\.com/watch/\?v=(?P<id>[\da-zA-Z]+)'
    _TESTS = [
        {
            'url': 'https://www.godtube.com/watch/?v=0C0CNNNU',
            'md5': '77108c1e4ab58f48031101a1a2119789',
            'info_dict': {
                'id': '0C0CNNNU',
                'ext': 'mp4',
                'title': 'Woman at the well.',
                'duration': 159,
                'timestamp': 1205712000,
                'uploader': 'beverlybmusic',
                'upload_date': '20080317',
                'thumbnail': r're:^https?://.*\.jpg$',
            },
        },
    ]

    def _real_extract(self, url):
        mobj = re.match(self._VALID_URL, url)
        video_id = mobj.group('id')

        config = self._download_xml(
            'http://www.godtube.com/resource/mediaplayer/%s.xml' % video_id.lower(),
            video_id, 'Downloading player config XML')

        video_url = config.find('file').text
        uploader = config.find('author').text
        timestamp = parse_iso8601(config.find('date').text)
        duration = parse_duration(config.find('duration').text)
        thumbnail = config.find('image').text

        media = self._download_xml(
            'http://www.godtube.com/media/xml/?v=%s' % video_id, video_id, 'Downloading media XML')

        title = media.find('title').text

        return {
            'id': video_id,
            'url': video_url,
            'title': title,
            'thumbnail': thumbnail,
            'timestamp': timestamp,
            'uploader': uploader,
            'duration': duration,
        }
[godtube] Add extractor (Closes #3367) 2014-07-27 03:38:05 +08:00			`from __future__ import unicode_literals`

			`import re`

			`from .common import InfoExtractor`
			`from ..utils import (`
			`parse_duration,`
			`parse_iso8601,`
			`)`


			`class GodTubeIE(InfoExtractor):`
			`_VALID_URL = r'https?://(?:www\.)?godtube\.com/watch/\?v=(?P<id>[\da-zA-Z]+)'`
			`_TESTS = [`
			`{`
			`'url': 'https://www.godtube.com/watch/?v=0C0CNNNU',`
			`'md5': '77108c1e4ab58f48031101a1a2119789',`
			`'info_dict': {`
			`'id': '0C0CNNNU',`
			`'ext': 'mp4',`
			`'title': 'Woman at the well.',`
			`'duration': 159,`
			`'timestamp': 1205712000,`
			`'uploader': 'beverlybmusic',`
			`'upload_date': '20080317',`
Fix "invalid escape sequences" error on Python 3.6 2017-01-02 20:08:07 +08:00			`'thumbnail': r're:^https?://.*\.jpg$',`
[godtube] Add extractor (Closes #3367) 2014-07-27 03:38:05 +08:00			`},`
			`},`
			`]`

			`def _real_extract(self, url):`
			`mobj = re.match(self._VALID_URL, url)`
			`video_id = mobj.group('id')`

			`config = self._download_xml(`
			`'http://www.godtube.com/resource/mediaplayer/%s.xml' % video_id.lower(),`
			`video_id, 'Downloading player config XML')`

[godtube] Fix on Python 2.6 2014-09-29 11:51:41 +08:00			`video_url = config.find('file').text`
			`uploader = config.find('author').text`
			`timestamp = parse_iso8601(config.find('date').text)`
			`duration = parse_duration(config.find('duration').text)`
			`thumbnail = config.find('image').text`
[godtube] Add extractor (Closes #3367) 2014-07-27 03:38:05 +08:00
			`media = self._download_xml(`
			`'http://www.godtube.com/media/xml/?v=%s' % video_id, video_id, 'Downloading media XML')`

[godtube] Fix on Python 2.6 2014-09-29 11:51:41 +08:00			`title = media.find('title').text`
[godtube] Add extractor (Closes #3367) 2014-07-27 03:38:05 +08:00
			`return {`
			`'id': video_id,`
			`'url': video_url,`
			`'title': title,`
			`'thumbnail': thumbnail,`
			`'timestamp': timestamp,`
			`'uploader': uploader,`
			`'duration': duration,`
			`}`