猫史档案馆


【Python作品分享】20行Python代码 批量抓取免费高清图片!【教程贴】

用户:熊熊糖果熊熊糖果查看:0 回复:1 评论:0 创建时间:2019-10-27T11:24:30


【作品展示】

center_image

 

【作品介绍】

《编程猫》第二期66~67页内容代码编写完成。

 

【作品源代码】

import requests
from bs4 import BeautifulSoup
import random
import time
from fake_useragent import UserAgent
for page in range(1,11):
    fst_url=r'https://colorhub.me/search?tag=data&page={}'.format(page)
    UA=UserAgent()
    fst_response=requests.get(fst_url,headers={'User-Agent':UA.random})
    fst_soup=BeautifulSoup(fst_response.text)
    sec_urls=[i.find('a')['href'] for i in fst_soup.findAll(name='div',attrs={'class':'card'})]
    pic_names=[i.find('a')['title'] for i in fst_soup.findAll(name='div',attrs={'class':'card'})]
for sec_url,pic_name in zip(sec_urls,pic_names):
    UA=UserAgent()
    ua=UA.random
    sec_response=requests.get(sec_url,headers={'User-Agent':ua})
    sec_soup=BeautifulSoup(sec_response.text)
    pic_url='https:'+\
        sec_soup.find('img',{'class':'card-img-top'})['src']
    pic_response=requests.get(pic_url,headers={'User-Agent':ua})
    with open(pic_name+'.jpg',mode='wb') as fn:
        fn.write(pic_response.content)
    seconds=random.uniform(1,3)
    time.sleep(seconds)

 

【提示】

部分含有Python第三方库相关内容的作品,在海龟编辑器网页端无法运行哦!如遇到这种情况,可以打开下面的链接,下载海龟编辑器客户端:

https://python.codemao.cn


回复

上一页1 页 / 共 1下一页
QBZ_QBZ_

爬虫啊哥们

点赞0


评论