国产成人精品亚洲777人妖,欧美日韩精品一区视频,最新亚洲国产,国产乱码精品一区二区亚洲

您的位置:首頁技術文章
文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢?

瀏覽:91日期:2022-06-28 18:47:10

問題描述

初學python,在使用scray 爬蟲時,遇到html的特殊字符,于是百度搜看了下文檔:

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示:import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件,看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功,遇到的問題是,return data 這一句,返回數據是無效的?

請問,有沒有就幾句代碼解決轉義的,如果沒有第二種方法里如何才有返回值?

問題解答

回答1:

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’&lt;abc&gt;&nbsp;’txt = html_parser.unescape(s)print(txt)# 結果:<abc>

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 界首市| 昌邑市| 尖扎县| 鸡东县| 定兴县| 增城市| 玛多县| 逊克县| 虞城县| 平凉市| 阿尔山市| 舟山市| 德格县| 天门市| 辽阳县| 克东县| 蒙自县| 都昌县| 新野县| 揭东县| 肥东县| 吉安市| 长汀县| 会泽县| 长白| 颍上县| 融水| 舞阳县| 凯里市| 岚皋县| 韩城市| 尼木县| 平邑县| 葫芦岛市| 尤溪县| 喀喇| 吉木萨尔县| 万载县| 平塘县| 农安县| 夏邑县|