python爬取酷狗音乐Top500榜单
作者:Ding?Jiaxiong 时间:2023-01-26 03:09:17
网页情况
爬取数据包含
歌曲排名、歌手、歌曲名、歌曲时长
python 代码
import requests #请求网页获取网页数据
from bs4 import BeautifulSoup #解析网页数据
import time #时间库
#user-Agent,伪装成浏览器,便于爬虫的稳定性
headers = {
"User-Agent":
"Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/97.0.4692.71 Safari/537.36"
}
def get_info(url):
web_data = requests.get(url,headers= headers)
soup = BeautifulSoup(web_data.text,'lxml')
ranks = soup.select('span.pc_temp_num')
titles = soup.select('div.pc_temp_songlist > ul > li > a')
times = soup.select('span.pc_temp_tips_r > span')
for rank,title,time in zip(ranks,titles,times):
data = {
"rank":rank.get_text().strip(),
"singer":title.get_text().replace("\n","").replace("\t","").split('-')[1],
"song":title.get_text().replace("\n","").replace("\t","").split('-')[0],
"time":time.get_text().strip()
}
print(data)
if __name__ == '__main__':
urls = ["https://www.kugou.com/yy/rank/home/{}-8888.html".format(str(i)) for i in range(1,24)]
for url in urls:
get_info(url)
time.sleep(1)
运行效果
来源:https://blog.csdn.net/weixin_44226181/article/details/122800556
标签:Python,酷狗,音乐
0
投稿
猜你喜欢
淘宝搜索框研究报告
2010-07-27 12:49:00
Python 使用Numpy对矩阵进行转置的方法
2022-07-10 09:53:19
MySql超详细讲解表的用法
2024-01-28 02:06:29
python中使用xlrd、xlwt操作excel表格详解
2023-06-25 03:59:51
Python字典中items()函数案例详解
2021-02-23 04:47:31
SQL语句分组获取记录的第一条数据的方法
2024-01-12 17:23:13
python调用fortran模块
2023-12-22 23:36:40
Python中Tkinter组件Menu的具体使用
2023-09-11 12:46:26
Pytorch中使用TensorBoard详情
2023-07-11 01:14:56
从算法入手讲解SQL Server的典型示例
2008-12-18 14:51:00
linux下mysql命令
2011-01-04 19:42:00
前端使用svg图片改色实现示例
2022-03-14 03:54:14
MySQL如何查询Binlog 生成时间
2024-01-19 23:34:57
python无限生成不重复(字母,数字,字符)组合的方法
2021-02-15 14:08:49
js高亮关键词系列方法
2008-01-22 11:11:00
解决python打不开文件(文件不存在)的问题
2021-10-15 02:39:46
如何利用Python获取鼠标的实时位置
2022-08-11 07:00:33
段正淳的css笔记(1)分类之间的横竖线
2007-11-01 21:47:00
协同开发巧用gitignore中间件避免网络请求携带登录信息
2022-10-24 13:20:00
完美解决go Fscanf 在读取文件时出现的问题
2024-02-15 11:29:50