文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？

瀏覽：72日期：2022-06-28 18:47:10

問題描述

初學python，在使用scray 爬蟲時，遇到html的特殊字符，于是百度搜看了下文檔：

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示：import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件，看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功，遇到的問題是，return data 這一句，返回數據是無效的？

請問，有沒有就幾句代碼解決轉義的，如果沒有第二種方法里如何才有返回值？

問題解答

回答1：

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’<abc> ’txt = html_parser.unescape(s)print(txt)# 結果：<abc>

Python 編程

上一條：python - Django中如何使用異步下一條：python - ubuntu16.04 lxml的報錯

相關文章：

1. 對mysql某個字段監控的功能2. html - vue項目中用到了elementUI問題3. html5 - ElementUI table中el-table-column怎么設置百分比顯示。4. javascript - js中向下取整5. python - 為什么正常輸出中文沒有亂碼，zip函數之后出現中文編程unicode編碼的問題，我是遍歷輸出的啊。6. showpassword里的this 是什么意思？代表哪個元素7. javascript - windows下如何使用babel，遇到了困惑8. java enum 變量不能再case里面重復定義？9. JavaScript事件10. javascript - table列過多，有什么插件可以提供列排序和選擇顯示列的功能

排行榜

					
					android - 用textview顯示html時如何寫imagegetter獲取網絡圖片
javascript - table列過多，有什么插件可以提供列排序和選擇顯示列的功能
docker gitlab 如何git clone？
docker - 各位電腦上有多少個容器啊？容器一多，自己都搞混了，咋辦呢？
golang - 用IDE看docker源碼時的小問題
c++ - QWebEngineView加載url后直接點擊鏈接沒有反應要怎么解決？
python - 為什么正常輸出中文沒有亂碼，zip函數之后出現中文編程unicode編碼的問題，我是遍歷輸出的啊。
javascript - windows下如何使用babel，遇到了困惑
showpassword里的this 是什么意思？代表哪個元素
java enum 變量不能再case里面重復定義？
html - vue項目中用到了elementUI問題
				

熱門標簽

av一区二区在线观看_亚洲男人的天堂网站_日韩亚洲视频_在线成人免费_欧美日韩精品免费观看视频_久草视

python - pythoh3 下 ’&lt;abc&gt;’ 遇到這樣的html轉義符如何自動轉義呢？

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？