文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？

瀏覽：91日期：2022-06-28 18:47:10

問題描述

初學python，在使用scray 爬蟲時，遇到html的特殊字符，于是百度搜看了下文檔：

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示：import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件，看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功，遇到的問題是，return data 這一句，返回數據是無效的？

請問，有沒有就幾句代碼解決轉義的，如果沒有第二種方法里如何才有返回值？

問題解答

回答1：

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’<abc> ’txt = html_parser.unescape(s)print(txt)# 結果：<abc>

Python 編程

上一條：python - Django中如何使用異步下一條：python - ubuntu16.04 lxml的報錯

相關文章：

1. html5 - 如何實現帶陰影的不規則容器？2. html5 - 只用CSS如何實現input框的寬度隨框里輸入的內容長短自動適應？3. javascript - 三目運算符的一些問題4. python - uwsgi+django的搭建問題5. css - 移動端字體設置問題6. javascript - ueditor引入報錯問題7. c++ - win7在不刪除管理員密碼的前提下（密碼不為空），如何設置開機不需要密碼？8. html5 - H5 video 問題9. javascript - 移動端上不能實現拖拽布局嗎？10. javascript - 循環嵌套多個promise應該如何實現？

排行榜

					
					javascript - nodejs log4js收集訪問者信息的問題
docker容器呢SSH為什么連不通呢？
docker images顯示的鏡像過多，狗眼被亮瞎了，怎么辦？
docker綁定了nginx端口 外部訪問不到
docker-compose 為何找不到配置文件？
mac里的docker如何命令行開啟呢？
html5 - 只用CSS如何實現input框的寬度隨框里輸入的內容長短自動適應？
html5 - Provisional headers are shown
python - uwsgi+django的搭建問題
javascript - 移動端上不能實現拖拽布局嗎？
html5 - H5 video 問題
				

熱門標簽

国产成人精品亚洲777人妖,欧美日韩精品一区视频,最新亚洲国产,国产乱码精品一区二区亚洲

python - pythoh3 下 ’&lt;abc&gt;’ 遇到這樣的html轉義符如何自動轉義呢？

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？