Improve some _VALID_URLs

[youtube-dl] / youtube_dl / extractor / kuwo.py
diff --git a/youtube_dl/extractor/kuwo.py b/youtube_dl/extractor/kuwo.py

index b1d460599e2dafb16d7f16a963de5764e0577b3b..ba621ca7b5edb205f83e3cc42d3596d3c332e23f 100644 (file)
--- a/youtube_dl/extractor/kuwo.py
+++ b/youtube_dl/extractor/kuwo.py
@@ -4,6 +4,7 @@ from __future__ import unicode_literals
  import re
  
  from .common import InfoExtractor
+from ..compat import compat_urlparse
  from ..utils import (
      get_element_by_id,
      clean_html,
@@ -58,7 +59,7 @@ class KuwoBaseIE(InfoExtractor):
  class KuwoIE(KuwoBaseIE):
      IE_NAME = 'kuwo:song'
      IE_DESC = '酷我音乐'
-    _VALID_URL = r'https?://www\.kuwo\.cn/yinyue/(?P<id>\d+)'
+    _VALID_URL = r'https?://(?:www\.)?kuwo\.cn/yinyue/(?P<id>\d+)'
      _TESTS = [{
          'url': 'http://www.kuwo.cn/yinyue/635632/',
          'info_dict': {
@@ -138,7 +139,7 @@ class KuwoIE(KuwoBaseIE):
  class KuwoAlbumIE(InfoExtractor):
      IE_NAME = 'kuwo:album'
      IE_DESC = '酷我音乐 - 专辑'
-    _VALID_URL = r'https?://www\.kuwo\.cn/album/(?P<id>\d+?)/'
+    _VALID_URL = r'https?://(?:www\.)?kuwo\.cn/album/(?P<id>\d+?)/'
      _TEST = {
          'url': 'http://www.kuwo.cn/album/502294/',
          'info_dict': {
@@ -199,7 +200,7 @@ class KuwoChartIE(InfoExtractor):
  class KuwoSingerIE(InfoExtractor):
      IE_NAME = 'kuwo:singer'
      IE_DESC = '酷我音乐 - 歌手'
-    _VALID_URL = r'https?://www\.kuwo\.cn/mingxing/(?P<id>[^/]+)'
+    _VALID_URL = r'https?://(?:www\.)?kuwo\.cn/mingxing/(?P<id>[^/]+)'
      _TESTS = [{
          'url': 'http://www.kuwo.cn/mingxing/bruno+mars/',
          'info_dict': {
@@ -242,8 +243,9 @@ class KuwoSingerIE(InfoExtractor):
                  query={'artistId': artist_id, 'pn': page_num, 'rn': self.PAGE_SIZE})
  
              return [
-                self.url_result(song_url, 'Kuwo') for song_url in re.findall(
-                    r'<div[^>]+class="name"><a[^>]+href="(http://www\.kuwo\.cn/yinyue/\d+)',
+                self.url_result(compat_urlparse.urljoin(url, song_url), 'Kuwo')
+                for song_url in re.findall(
+                    r'<div[^>]+class="name"><a[^>]+href="(/yinyue/\d+)',
                      webpage)
              ]
  
@@ -294,7 +296,7 @@ class KuwoCategoryIE(InfoExtractor):
  class KuwoMvIE(KuwoBaseIE):
      IE_NAME = 'kuwo:mv'
      IE_DESC = '酷我音乐 - MV'
-    _VALID_URL = r'https?://www\.kuwo\.cn/mv/(?P<id>\d+?)/'
+    _VALID_URL = r'https?://(?:www\.)?kuwo\.cn/mv/(?P<id>\d+?)/'
      _TEST = {
          'url': 'http://www.kuwo.cn/mv/6480076/',
          'info_dict': {