python怎么去除html标签

python去除html标签的方法:1、“pattern.sub('',html)”方法;2、“BeautifulSoup(html,'html.parser')”方法;3、“response.xpath('string(.)')”方法。

本文操作环境:windows7系统、python3.6.4版,DELL G3电脑。

python去除html标签的几种方法

import refrom bs4 import BeautifulSoupfrom lxml import etree html = '<p>你好</p><br/><font>哈哈</font><b>大家好</b>' # 方法一pattern = re.compile(r'<[^>]+>',re.S)result = pattern.sub('', html)print(result) <br># 方法二soup = BeautifulSoup(html,'html.parser')print(soup.get_text()) # 方法三response = etree.HTML(text=html)# print(dir(response))print(response.xpath('string(.)'))  # 你好哈哈大家好# 你好哈哈大家好# 你好哈哈大家好

【推荐:python视频教程】

以上就是python怎么去除html标签的详细内容,更多请关注自由互联其它相关文章!

【本文转自:海外高防服务器 krgf.html 欢迎留下您的宝贵建议】黄色蓝色或者砖红色,犹如童话世界。

python怎么去除html标签

相关文章:

你感兴趣的文章:

标签云: