python抓取网页新闻前5条并表格化
时间: 2023-04-04 10:03:33 浏览: 104
Python网页数据抓取以及表格的制作
您好,我可以回答这个问题。要抓取网页新闻前5条并表格化,可以使用Python中的BeautifulSoup库和requests库。首先,使用requests库获取网页内容,然后使用BeautifulSoup库解析网页内容,找到新闻标题和链接,最后将它们放入表格中。具体实现可以参考以下代码:
```python
import requests
from bs4 import BeautifulSoup
import pandas as pd
url = 'https://news.baidu.com/'
res = requests.get(url)
soup = BeautifulSoup(res.text, 'html.parser')
news_list = soup.select('.ulist li')
data = []
for news in news_list[:5]:
title = news.select_one('a').text
link = news.select_one('a')['href']
data.append({'标题': title, '链接': link})
df = pd.DataFrame(data)
print(df)
```
这段代码会抓取百度新闻首页的前5条新闻,并将它们放入一个表格中,表格的列分别为“标题”和“链接”。
阅读全文