python爬酷狗音乐所有歌手

时间: 2023-07-17 10:53:40 浏览: 61
为了爬取酷狗音乐的所有歌手,我们可以使用Python中的爬虫库requests和正则表达式re来实现。以下是一个简单的爬虫代码示例: ```python import requests import re # 获取所有歌手的URL url = "http://www.kugou.com/yy/singer/index/1-all-0.html" response = requests.get(url) html = response.text # 使用正则表达式匹配每个歌手的URL和名称 pattern = r'<a href="/yy/singer/home/\d+.html" title="(.+?)" target="_blank">' singers = re.findall(pattern, html) # 输出所有歌手的名称 for singer in singers: print(singer) ``` 这段代码首先通过requests库获取包含所有歌手的页面HTML代码,然后使用正则表达式匹配每个歌手的URL和名称,并输出所有歌手的名称。你可以根据需要修改代码以满足你的需求。
相关问题

python爬虫酷狗音乐

你可以使用Python来编写爬虫程序来获取酷狗音乐的数据。以下是一个简单的示例代码: ```python import requests from bs4 import BeautifulSoup # 设置请求头信息,模拟浏览器访问 headers = { 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/58.0.3029.110 Safari/537.3' } # 发送GET请求获取网页内容 url = 'http://www.kugou.com/yy/rank/home/1-8888.html?from=homepage' response = requests.get(url, headers=headers) html = response.text # 使用BeautifulSoup解析html soup = BeautifulSoup(html, 'html.parser') # 找到包含歌曲信息的元素 songs = soup.find_all('li', class_='pc_temp_songlist') # 遍历歌曲信息并获取相关数据 for song in songs: # 获取歌曲名称 name = song.find('a', class_='pc_temp_songname').text.strip() # 获取歌手名称 singer = song.find('a', class_='pc_temp_singername').text.strip() # 打印歌曲信息 print(f"歌曲:{name},歌手:{singer}") ``` 这段代码使用了requests库发送GET请求,并使用BeautifulSoup库解析HTML页面。你可以根据自己的需求进一步处理获取到的数据。请注意,爬取网站的数据需要遵守相关的法律法规,确保你的行为合法合规。

python爬虫酷狗音乐top20

以下是爬取酷狗音乐TOP20的Python代码: ```python import requests from bs4 import BeautifulSoup import csv # 请求头信息 headers = { 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/58.0.3029.110 Safari/537.3'} # 获取HTML页面 def get_html(url): try: r = requests.get(url, headers=headers) r.raise_for_status() r.encoding = r.apparent_encoding return r.text except: return "" # 解析HTML页面 def parse_html(html): soup = BeautifulSoup(html, 'html.parser') ranks = soup.find_all('span', class_='pc_temp_num') titles = soup.find_all('a', class_='pc_temp_songname') times = soup.find_all('span', class_='pc_temp_time') for rank, title, time in zip(ranks, titles, times): rank = rank.get_text().strip() title = title.get_text().split('-')[1].strip() author = title.get_text().split('-')[0].strip() time = time.get_text().strip() yield {'rank': rank, 'title': title, 'author': author, 'time': time} # 保存数据到CSV文件 def save_to_csv(data): with open('music.csv', 'w', newline='', encoding='utf-8-sig') as f: writer = csv.writer(f) writer.writerow(['排名', '歌曲名称', '歌手', '时长']) for item in data: writer.writerow([item['rank'], item['title'], item['author'], item['time']]) # 主函数 def main(): url = 'https://www.kugou.com/yy/rank/home/1-8888.html?from=rank' html = get_html(url) data = parse_html(html) save_to_csv(data) if __name__ == '__main__': main() ```

相关推荐

最新推荐

recommend-type

Python爬虫 json库应用详解

Python爬虫(三) 学习Python爬虫过程中的心得体会以及知识点的整理,方便我自己查找,也希望可以和大家一起交流。 —— json库应用详解 —— 文章目录Python爬虫(三)—— json库应用详解 ——一.json库简介二.将...
recommend-type

Python爬虫实现百度翻译功能过程详解

主要介绍了Python爬虫实现百度翻译功能过程详解,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
recommend-type

python爬虫之xpath的基本使用详解

本篇文章主要介绍了python爬虫之xpath的基本使用详解,小编觉得挺不错的,现在分享给大家,也给大家做个参考。一起跟随小编过来看看吧
recommend-type

python 爬虫 实现增量去重和定时爬取实例

今天小编就为大家分享一篇python 爬虫 实现增量去重和定时爬取实例,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
recommend-type

Python3爬楼梯算法示例

主要介绍了Python3爬楼梯算法,涉及Python基于面向对象的字符串遍历、切片、运算等相关操作技巧,需要的朋友可以参考下
recommend-type

zigbee-cluster-library-specification

最新的zigbee-cluster-library-specification说明文档。
recommend-type

管理建模和仿真的文件

管理Boualem Benatallah引用此版本:布阿利姆·贝纳塔拉。管理建模和仿真。约瑟夫-傅立叶大学-格勒诺布尔第一大学,1996年。法语。NNT:电话:00345357HAL ID:电话:00345357https://theses.hal.science/tel-003453572008年12月9日提交HAL是一个多学科的开放存取档案馆,用于存放和传播科学研究论文,无论它们是否被公开。论文可以来自法国或国外的教学和研究机构,也可以来自公共或私人研究中心。L’archive ouverte pluridisciplinaire
recommend-type

实现实时数据湖架构:Kafka与Hive集成

![实现实时数据湖架构:Kafka与Hive集成](https://img-blog.csdnimg.cn/img_convert/10eb2e6972b3b6086286fc64c0b3ee41.jpeg) # 1. 实时数据湖架构概述** 实时数据湖是一种现代数据管理架构,它允许企业以低延迟的方式收集、存储和处理大量数据。与传统数据仓库不同,实时数据湖不依赖于预先定义的模式,而是采用灵活的架构,可以处理各种数据类型和格式。这种架构为企业提供了以下优势: - **实时洞察:**实时数据湖允许企业访问最新的数据,从而做出更明智的决策。 - **数据民主化:**实时数据湖使各种利益相关者都可
recommend-type

2. 通过python绘制y=e-xsin(2πx)图像

可以使用matplotlib库来绘制这个函数的图像。以下是一段示例代码: ```python import numpy as np import matplotlib.pyplot as plt def func(x): return np.exp(-x) * np.sin(2 * np.pi * x) x = np.linspace(0, 5, 500) y = func(x) plt.plot(x, y) plt.xlabel('x') plt.ylabel('y') plt.title('y = e^{-x} sin(2πx)') plt.show() ``` 运行这段
recommend-type

JSBSim Reference Manual

JSBSim参考手册,其中包含JSBSim简介,JSBSim配置文件xml的编写语法,编程手册以及一些应用实例等。其中有部分内容还没有写完,估计有生之年很难看到完整版了,但是内容还是很有参考价值的。