您好,登录后才能下订单哦!
密码登录
登录注册
点击 登录注册 即表示同意《亿速云用户服务条款》
小编给大家分享一下python如何爬取酷狗音乐排行榜,相信大部分人都还不怎么了解,因此分享这篇文章给大家参考一下,希望大家阅读完这篇文章后大有收获,下面让我们一起去了解一下吧!
具体内容如下
#coding=utf-8
from pymongo import MongoClient
import time
import requests
from lxml import etree
client = MongoClient() #连接mongo
hello = client.hello #连接数据库
user = hello.song #连接表
headers = {
'User-Agent': 'Mozilla/5.0 (Android 6.0; Nexus 5 Build/MRA58N)\
AppleWebKit/537.36 (KHTML, like Gecko) Chrome/65.0.3325.181 Mobile Safari/537.36'}
def get_info(url):
'''
get源码,encode,解析,xpath,保存
'''
response = requests.get(url, headers=headers)
response = response.text.encode('utf-8')
selector = etree.HTML(response)
soup = selector.xpath('//*[@class="pc_temp_songlist "]/ul//li/a/text()')
#保存到本地
# with open('aa.txt','a') as f:
# for i in soup:
# f.write(i.encode('utf-8') + '\n')
#存入数据库
for i in soup:
user.insert({'song': i})
if __name__ == '__main__':
urls = ['http://www.kugou.com/yy/rank/home/{}-8888.html?from=rank'.format(str(i)) for i in range(1, 24)]
for url in urls:
print(url)
get_info(url)以上是“python如何爬取酷狗音乐排行榜”这篇文章的所有内容,感谢各位的阅读!相信大家都有了一定的了解,希望分享的内容对大家有所帮助,如果还想学习更多知识,欢迎关注亿速云行业资讯频道!
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。