python使用beautifulsoup4爬取酷狗音乐代码实例-侯体宗的博客

python使用beautifulsoup4爬取酷狗音乐代码实例
Python / 管理员发布于 8年前 265

这篇文章主要介绍了python使用beautifulsoup4爬取酷狗音乐代码实例,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下

小编经常在网上听一些音乐但是有一些网站好多音乐都是付费下载的正好我会点爬虫技术，空闲时间写了一份，截止4月底没有问题的，会下载到当前目录，只要按照bs4库就好，

安装方法：pip install beautifulsoup4

完整代码如下：双击就能直接运行

from bs4 import BeautifulSoupimport requestsimport reheaders = {'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/72.0.3626.109 Safari/537.36'}url='https://songsearch.kugou.com/song_search_v2?&page=1&pagesize=30&userid=-1&clientver=&platform=WebFilter&tag=em&filter=2&iscorrection=1&privilege_filter=0&_=1555124510574'#想要爬取别的网页直接修改这个json数据地址就行r=requests.get(url,headers=headers)soup=BeautifulSoup(r.text,'lxml')title_list=soup.select('.pc_temp_songlist ul li')hash=re.findall(r',"FileHash":"(.*?)"',r.text)hash1=re.findall(r',"FileName":"(.*?)"',r.text)#直接用正则匹配隐藏的数据print(hash)print(hash1)q=0for url in hash:url_a=f'https://wwwapi.kugou.com/yy/index.php?r=play/getdata&callback=jQuery1910212680783679835_1555073815772&hash={url}&album_id=18784389'#这个URL不用修改的c=requests.get(url_a,headers=headers)a=c.text[40:-3]b=re.findall('"play_url":"(.*)","authors":',a)[0]b1=re.sub(r"\\",'',b)f = requests.get(b1)with open(hash1[q]+'.mp3','wb')as d:d.write(f.content)print(hash1[q])q+=1

爬取酷狗的唯一难点就是hash值的获取找了一个多小时才找到，比网易云好点就是自己不用写一个哈希值，酷狗是自己就存在的能找到，网易云是需要函数生成的。

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

上一条：
python 实现生成均匀分布的点
下一条：
python3中numpy函数tile的用法详解

0条评论 (评论内容有缓存机制,请悉知!)

最新最热

近期评论
test1 在
opencode + Oh-my-openagent,我的第一个免费的ai编程智能体管家:Sisyphus中评论 test..
122 在
学历：一种延缓就业设计，生活需求下的权衡之选中评论工作几年后，报名考研了，到现在还没认真学习备考，迷茫中。作为一名北漂互联网打工人..
Zita 在
Google AI Studio升级全栈 vibe coding体验，可直接构建带登录和数据库的应用中评论 111222..
123 在
Clash for Windows作者删库跑路了，github已404中评论按理说只要你在国内，所有的流量进出都在监控范围内，不管你怎么隐藏也没用，想搞你分..
原梓番博客在
在Laravel框架中使用模型Model分表最简单的方法中评论好久好久都没看友情链接申请了，今天刚看，已经添加。..

Top