Added uploaded date for Dailymotion

[youtube-dl] / youtube_dl / InfoExtractors.py
diff --git a/youtube_dl/InfoExtractors.py b/youtube_dl/InfoExtractors.py

index bdb2ec3110321c2628b281d36062ffa1bdb0905f..9e5ea7c61870f19ae30cea7670867584226123f8 100644 (file)
--- a/youtube_dl/InfoExtractors.py
+++ b/youtube_dl/InfoExtractors.py
@@ -616,7 +616,7 @@ class MetacafeIE(InfoExtractor):
  class DailymotionIE(InfoExtractor):
         """Information Extractor for Dailymotion"""
  
-       _VALID_URL = r'(?i)(?:https?://)?(?:www\.)?dailymotion\.[a-z]{2,3}/video/([^_/]+)_([^/]+)'
+       _VALID_URL = r'(?i)(?:https?://)?(?:www\.)?dailymotion\.[a-z]{2,3}/video/([^/]+)'
         IE_NAME = u'dailymotion'
  
         def __init__(self, downloader=None):
@@ -637,7 +637,7 @@ class DailymotionIE(InfoExtractor):
                         self._downloader.trouble(u'ERROR: invalid URL: %s' % url)
                         return
  
-               video_id = mobj.group(1)
+               video_id = mobj.group(1).split('_')[0].split('?')[0]
  
                 video_extension = 'mp4'
  
@@ -662,10 +662,12 @@ class DailymotionIE(InfoExtractor):
                 elif 'sdURL' in flashvars: max_quality = 'sdURL'
                 else: max_quality = 'ldURL'
                 mobj = re.search(r'"' + max_quality + r'":"(.+?)"', flashvars)
+               if mobj is None:
+                       mobj = re.search(r'"video_url":"(.*?)",', flashvars)
                 if mobj is None:
                         self._downloader.trouble(u'ERROR: unable to extract media URL')
                         return
-               video_url = mobj.group(1).replace('\\/', '/')
+               video_url = urllib.unquote(mobj.group(1)).replace('\\/', '/')
  
                 # TODO: support choosing qualities
  
@@ -681,11 +683,16 @@ class DailymotionIE(InfoExtractor):
                         return
                 video_uploader = mobj.group(1)
  
+               video_upload_date = u'NA'
+               mobj = re.search(r'<div class="[^"]*uploaded_cont[^"]*" title="[^"]*">([0-9]{2})-([0-9]{2})-([0-9]{4})</div>', webpage)
+               if mobj is not None:
+                       video_upload_date = mobj.group(3) + mobj.group(2) + mobj.group(1)
+
                 return [{
                         'id':           video_id.decode('utf-8'),
                         'url':          video_url.decode('utf-8'),
                         'uploader':     video_uploader.decode('utf-8'),
-                       'upload_date':  u'NA',
+                       'upload_date':  video_upload_date,
                         'title':        video_title,
                         'ext':          video_extension.decode('utf-8'),
                         'format':       u'NA',