av一区二区在线观看_亚洲男人的天堂网站_日韩亚洲视频_在线成人免费_欧美日韩精品免费观看视频_久草视

您的位置:首頁技術文章
文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢?

瀏覽:71日期:2022-06-28 18:47:10

問題描述

初學python,在使用scray 爬蟲時,遇到html的特殊字符,于是百度搜看了下文檔:

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示:import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件,看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功,遇到的問題是,return data 這一句,返回數據是無效的?

請問,有沒有就幾句代碼解決轉義的,如果沒有第二種方法里如何才有返回值?

問題解答

回答1:

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’&lt;abc&gt;&nbsp;’txt = html_parser.unescape(s)print(txt)# 結果:<abc>

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 国产欧美日韩精品一区二区三区 | 精品国产乱码久久久久久影片 | 久久久精品视 | 午夜男人天堂 | 婷婷久久综合 | 一区二区三区av | 久久这里只有精品首页 | 亚洲欧美中文字幕在线观看 | 91色视频在线观看 | www.久 | 国产精品久久久久久吹潮 | 国产精品明星裸体写真集 | 亚洲精品毛片av | 免费av电影网站 | 久草视频在线播放 | 全免费a级毛片免费看视频免 | 狠狠做六月爱婷婷综合aⅴ 国产精品视频网 | 久久久黑人 | 日韩a在线 | 亚洲欧美日韩精品久久亚洲区 | 国产在线一区二区三区 | 国产综合视频 | 色婷婷综合久久久久中文一区二区 | 日韩中文一区 | 古典武侠第一页久久777 | 黄色a视频 | www久久久 | 丁香婷婷久久久综合精品国产 | 91精品一区 | 日韩一级免费观看 | 欧美日韩国产精品一区 | 午夜精品一区二区三区在线观看 | 国产精品久久久久久久免费观看 | 亚洲国产精品成人 | 亚洲欧美国产视频 | 日韩精品1区2区3区 国产精品国产成人国产三级 | 蜜桃精品视频在线 | 男人影音 | 91av国产在线视频 | 国产精品资源在线观看 | 亚洲啊v|