这篇文章将为大家详细讲解有关Python中lxml解析HTML并用xpath获取元素的示例代码,小编觉得挺实用的,因此分享给大家做个参考,希望大家阅读完这篇文章后可以有所收获。
代码
使用方法见注释
#-*- coding: UTF-8 -*- from lxml import etree source = u''' <div><p class="p1" data-a="1">测试数据1</p> <p class="p1" data-a="2">测试数据2</p> <p class="p1" data-a="3" > <strong class="s">测试数据3</strong></p> <p class="p1" data-a="4" width="200"><img src="1.jpg" class="img"/><br/> 图片</p> ''' # 从字符串解析 page = etree.HTML(source) # 元素列表 ps = page.xpath("//p") for p in ps: print u"属性:%s" % p.attrib print u"文本:%s" % p.text # 文本列表 ts = page.xpath("//p/text()") for t in ts: print t # xpath定位 ls = page.xpath('//p[@class="p1"][last()]/img') for l in ls: print l.attrib
python的五大特点:1.简单易学,开发程序时,专注的是解决问题,而不是搞明白语言本身。2.面向对象,与其他主要的语言如C++和Java相比, Python以一种非常强大又简单的方式实现面向对象编程。3.可移植性,Python程序无需修改就可以在各种平台上运行。4.解释性,Python语言写的程序不需要编译成二进制代码,可以直接从源代码运行程序。5.开源,Python是 FLOSS(自由/开放源码软件)之一。
关于“Python中lxml解析HTML并用xpath获取元素的示例代码”这篇文章就分享到这里了,希望以上内容可以对大家有一定的帮助,使各位可以学到更多知识,如果觉得文章不错,请把它分享出去让更多的人看到。
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。