猫史档案馆


【Python作品分享】get爬虫(python自带,无需下载)【作业帖】

用户:编码已破译编码已破译查看:0 回复:0 评论:0 创建时间:2019-10-07T13:53:40


【作品展示】

center_image

 

【作品介绍】

我好穷,没有requests,但是Python自带的urllib库就可以爬虫,殴业!

如果大家想学 爬虫 但没有request,就可以模仿我使用urllib哦!

 

【作品源代码】

from urllib import request#从网址库(urllib)导入爬虫模块(request)
from time import sleep#从时间库(time)导入等待函数(sleep)
print('你好,我是喵爬虫,我可以通过网址查到任何东西?')
#打印内容('你好,我是喵爬虫,我可以通过网址查到任何东西?')
while True:#喵循环(Ctrl+C可以阻止)
    http = input('请输入网址')#询问内容
    try:#尝试
        get = request.urlopen(http)#获取网址(http)
        get = get.read()#读取【获取网址的信息(get)】
    except:#如果发生错误
        print('          网址不正确 或 网址不存在 或 网址反爬虫')
    else:#如果没发生错误
        print((('总长度' + str(len(get))) + '个字符'), end='')
        #end代表最后面打印的内容
        sleep(1.2)#等待时间(1.2)秒
        print(',开始爬虫:')
        sleep(0.6)
        for i in range(0, len(get), 50):
            #用i遍历可送迭(range(0, len(get), 50))
            print(get[i:i + 50], end='')
            #get[i:i + 50]是指get的第i到i+50项{项数是从0开始的}
            sleep(0.4)
        print(get[i:])#get[i:]是指get的第i到最后一项
        print('已爬完')

 

【提示】

部分含有Python第三方库相关内容的作品,在海龟编辑器网页端无法运行哦!如遇到这种情况,可以打开下面的链接,下载海龟编辑器客户端:

https://python.codemao.cn


回复

上一页1 页 / 共 0下一页