猫史档案馆


爬取军人荣耀(得先下载requests,lxml)#pip install python包

用户:一只斑点狗一只斑点狗查看:0 回复:1 评论:0 创建时间:2023-04-05T11:57:31



import requests
from lxml import etree
import time
num = input('要爬取的章节(《军人荣耀》):')
start = time.time()
url = 'http://www.idejian.net/book/11746140/'+num+'.html'
resp = requests.get(url)
html = etree.H喵L(resp.text)
xpath = '/html/body/div/div[2]/div[2]/div[3]/div[4]/div/p/text()'
xml = html.xpath(xpath)
with open('军人荣耀(xml).txt','w',encoding='utf-8') as f:
for i in xml:
f.write(i.replace(' ', ''))
end = time.time()
print(end-start)
#print('over!!!') 


回复

上一页1 页 / 共 1下一页
一只斑点狗一只斑点狗

懂的都懂

点赞0


评论