html解析-BeautilfulSoup

html-css032

html解析-BeautilfulSoup,第1张

BeautilfulSoup是比较常用的一个html解析库

安装:pip install beautilfulsoup4

4个常用解析库

1.html.prase

2.xml

3.lxml

4.htm5lib

dmo操作

p.contents\p.children\p.silbing,p.parent\p.desantoranr\p.anstoer等等

获取属性,文本,

最最常用的css选择器:soup.select()

常用方法:find\findall

Requests库是用Python编写的,基于urllib,采用Apache2Licensed开源协议的HYDTTP库;相比urllib库,Requests库更加方便,可以节约我们大量的工作,完全满足HYDTTP测试需求;Requests库经常被用来进行接口测试,如果想系统的学习接口测试相关的技术,可以了解一下黑马程序员的软件测试课程,里面讲的非常详细。

requests-html只支持Python3.6及更新的版本,是一个解析HTML的库。

requests-html和其他解析HTML库最大的不同点在于HTML解析库一般都是专用的,所以我们需要用另一个HYDTTP库先把网页下载下来,然后传给那些HTML解析库。而requests-html自带了这个功能,所以在爬取网页等方面非常方便。