当前位置:   article > 正文

pythonhtml解析_python 解析html网页

python解析html网页

pyquery库是jQuery的Python实现,可以用于解析HTML网页内容,使用方法:

代码如下:

from pyquery import PyQuery as pq

1、可加载一段HTML字符串,或一个HTML文件,或是一个url地址,例:

代码如下:

d = pq("

hello")

d = pq(filename=path_to_html_file)

d = pq(url='http://www.baidu.com') # 此处url必须写全

2、html() 和 text() ——获取相应的HTML块或文本块,例:

代码如下:

p = pq("

hello")

p('head').html()  # 返回

hello

p('head').text()  # 返回hello

3、根据HTML标签来获取元素,例:

代码如下:

d = pq('

test 1

test 2

')

d('p')    # 返回[

,

]

print d('p')  # 返回

test 1

test 2

print d('p').html()  # 返回test 1

注意:当获取到的元素不只一个时,html()、text()方法只返回首个元素的相应内容块

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/天景科技苑/article/detail/1006304
推荐阅读
相关标签
  

闽ICP备14008679号