微信公众号搜"智元新知"关注
微信扫一扫可直接关注哦!

如何在lxml中获取html的源代码?

import urllib
import lxml.html
down='http://blog.sina.com.cn/s/blog_71f3890901017hof.html'
file=urllib.urlopen(down).read()
root=lxml.html.document_fromstring(file)
body=root.xpath('//div[@class="articalContent  "]')[0]
print body.text_content()

当我运行代码时,我得到的是文本内容,我如何获得它的html源代码,而不是文本内容

解决方法

使用

html = lxml.html.tostring(node)

并请:先阅读您正在使用的工具的基本文档.

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 dio@foxmail.com 举报,一经查实,本站将立刻删除。

相关推荐