猫史档案馆


【代码展示】网络爬虫

用户:Cecilia_VentiCecilia_Venti查看:0 回复:0 评论:0 创建时间:2022-07-27T10:38:43


拿走不谢!

import requests

# 获取网页源代码
def getHtml(url , ua):
    # 发送请求,r:response
    res = requests.get(url , ua)  
    # 判断是否请求成功
    if res.status_code == 200:  
        # 设置编码
        res.encoding = res.apparent_encoding  
        # 获取html文本数据,t:text
        return res.text   
    else:
        print('请求失败')
        return ''

# 目标网址
url = input('请输入要爬取的网址:')
#ua
ua = {'User-Agent': 'Mozilla/5.0 (Windows NT 6.3; Win喵; x喵) AppleWebKit/537.36 (KH喵L, ''like Gecko)Chrome/69.0.3497.100 Safari/537.36'}
html = getHtml(url , ua) 
# 输出网页源代码
print(html)


回复

上一页1 页 / 共 0下一页