时间:2021-05-22
这篇文章主要介绍了python使用beautifulsoup4爬取酷狗音乐代码实例,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
小编经常在网上听一些音乐但是有一些网站好多音乐都是付费下载的正好我会点爬虫技术,空闲时间写了一份,截止4月底没有问题的,会下载到当前目录,只要按照bs4库就好,
安装方法:pip install beautifulsoup4
完整代码如下:双击就能直接运行
from bs4 import BeautifulSoupimport requestsimport reheaders = {'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/72.0.3626.109 Safari/537.36'}url='https://songsearch.kugou.com/song_search_v2?&page=1&pagesize=30&userid=-1&clientver=&platform=WebFilter&tag=em&filter=2&iscorrection=1&privilege_filter=0&_=1555124510574'#想要爬取别的网页直接修改这个json数据地址就行r=requests.get(url,headers=headers)soup=BeautifulSoup(r.text,'lxml')title_list=soup.select('.pc_temp_songlist ul li')hash=re.findall(r',"FileHash":"(.*?)"',r.text)hash1=re.findall(r',"FileName":"(.*?)"',r.text)#直接用正则匹配隐藏的数据print(hash)print(hash1)q=0for url in hash:url_a=f'https:///yy/index.php?r=play/getdata&callback=jQuery1910212680783679835_1555073815772&hash={url}&album_id=18784389'#这个URL不用修改的c=requests.get(url_a,headers=headers)a=c.text[40:-3]b=re.findall('"play_url":"(.*)","authors":',a)[0]b1=re.sub(r"\\",'',b)f = requests.get(b1)with open(hash1[q]+'.mp3','wb')as d:d.write(f.content)print(hash1[q])q+=1爬取酷狗的唯一难点就是hash值的获取找了一个多小时才找到,比网易云好点就是自己不用写一个哈希值,酷狗是自己就存在的能找到,网易云是需要函数生成的。
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
本文实例为大家分享了python爬取足球联赛积分榜的具体代码,供大家参考,具体内容如下使用BeautifulSoup4解析爬取足球直播吧五大联赛积分榜信息;#!
python爬虫主要用两个库:Urllib和BeautifulSoup4。一个用来爬取网页,一个用来解析网页。 Urllib是Python内置的HTTP请
本文实例讲述了Python爬虫实现使用beautifulSoup4爬取名言网功能。分享给大家供大家参考,具体如下:爬取名言网top10标签对应的名言,并存储到m
本文为大家分享了python爬取酷狗音乐排行榜的具体代码,供大家参考,具体内容如下#coding=utf-8frompymongoimportMongoClie
本文实例为大家分享了python爬取网易云音乐评论的具体代码,供大家参考,具体内容如下importrequestsimportbs4importjsondefg