首页python爬虫知乎问答

python爬虫知乎问答

时间: 2023-11-19 10:07:14 浏览: 229

好的，关于Python爬虫知乎问答，你可以使用Python中的requests和BeautifulSoup库来实现。具体步骤如下： 1. 使用requests库发送HTTP请求，获取知乎问答页面的HTML源代码。 2. 使用BeautifulSoup库解析HTML源代码，提取出问题和回答的内容。 3. 将提取出的内容保存到本地文件或数据库中。以下是一个简单的示例代码： ```python import requests from bs4 import BeautifulSoup url = 'https://www.zhihu.com/question/1234567890' # 替换成你要爬取的知乎问答页面的URL headers = {'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/58.0.3029.110 Safari/537.3'} response = requests.get(url, headers=headers) soup = BeautifulSoup(response.text, 'html.parser') question = soup.find('h1', class_='QuestionHeader-title').text.strip() # 获取问题标题 answers = soup.find_all('div', class_='RichContent-inner') # 获取所有回答的内容 # 将问题和回答的内容保存到本地文件或数据库中 ```

阅读全文