用户:
Vincent_xiaobo查看:2 回复:1 评论:2 创建时间:2022-04-07T19:49:26
【作品展示】

【作品介绍】
爬虫抖音热榜
【作品源代码】
import requests
import bs4
import time
# 请求网页
# 设置请求头、降低请求频率,防止反爬虫
head = {
"User-Agent": "Mozilla/5.0 (Windows; U; Windows NT 5.1; it; rv:1.8.1.11) Gecko/20071127 Firefox/2.0.0.11"
}
time.sleep(1)
#TODO 修改下方需要爬取的网址
url = "https://tophub.today/n/K7GdaMgdQy"
# 解析网页、选取数据
res = requests.get(url, headers=head)
soup = bs4.BeautifulSoup(res.text, "lxml")
#TODO 修改下方爬取条件中的标签名、属性
data = soup.find_all("td", class_="al")
# 展示结果
i = 1
for n in data:
print(str(i) +'.'+ n.text)
i += 1
【提示】
部分含有Python第三方库相关内容的作品,在海龟编辑器网页端无法运行哦!如遇到这种情况,可以打开下面的链接,下载海龟编辑器客户端:
https://python.codemao.cn