猫史档案馆


新鲜的教程贴!一步步升级🆙爬虫高手!

用户:星空牧场星空牧场查看:2 回复:12 评论:2 创建时间:2020-05-26T15:49:05


爬虫教程第一天:reuqests入门:获取H喵L源码

代码:

import requests

url = 'http://www.cntour.cn/' strhtml = requests.get ( url ) print ( strhtml.text )   下节预告:post方法抓取数据,明天下午,我们不见不散哦!


回复

上一页1 页 / 共 1下一页
codewyxcodewyx

喵是什么

点赞0


评论


星空牧场星空牧场

粘贴默认,我重新发一下代码:

import requests

url = 'http://www.cntour/cn'

strhtml = requests.get(url)

print(strhtml.text)

#这里打印出来的是源代码,是网页JScript等的融合<html>框架,下期介绍BeautifulSoup解析网页数据

点赞0


评论


星空牧场星空牧场

喵l是html,编程猫社区自己弄的,html发出来就是喵l

点赞0


评论


wrmdcxywrmdcxy

你不会发帖吗?

用工具栏的一个"</>"图标。

像这样:

#codecodecodecode
print
int
#######
"1233"

点赞0


评论


星空牧场星空牧场

@未入门的程序员,介是<html>,不是注释

点赞0


评论


宏图大志EB9j宏图大志EB9j

e......

 

为什么不用Scrapy或PySpider?

???

为什么不用框架?

点赞0


评论


星空牧场星空牧场

因为后续解析网页要配合BeautifulSoup,所以这里推荐与requests的结合,pyquery也可以使用,但是在教程贴里面先不做展示,因为这个是高阶内容。

点赞0


评论


lsk666666lsk666666

h喵l是:

H

T

M

L

去掉换行

点赞0


评论


LYX_AWLYX_AW

import requests

url =  'http://www.cntour.cn/' strhtml = requests.get ( url ) print ( strhtml.text )

点赞0


评论


直接在谷歌浏览器打开网址链接,在https://或者http://前面加上view-source:就好了

点赞0


评论


中国旅游网?

点赞0


评论


sara少校sara少校

嗯6666

点赞0


评论