亚洲精品久久久中文字幕-亚洲精品久久片久久-亚洲精品久久青草-亚洲精品久久婷婷爱久久婷婷-亚洲精品久久午夜香蕉

您的位置:首頁技術文章
文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢?

瀏覽:51日期:2022-06-28 18:47:10

問題描述

初學python,在使用scray 爬蟲時,遇到html的特殊字符,于是百度搜看了下文檔:

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示:import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件,看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功,遇到的問題是,return data 這一句,返回數據是無效的?

請問,有沒有就幾句代碼解決轉義的,如果沒有第二種方法里如何才有返回值?

問題解答

回答1:

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’&lt;abc&gt;&nbsp;’txt = html_parser.unescape(s)print(txt)# 結果:<abc>

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 国产丰满美女做爰 | 欧美亚洲国产一区 | 欧美视频一区二区在线观看 | 特极毛片 | 精品中文字幕制服中文 | 亚洲国产精品午夜电影 | 99久久国产综合精品麻豆 | 国产三级日本三级美三级 | 在线视频毛片 | 不卡视频在线观看 | 国产免费私拍一区二区三区 | 国产一区二区三区在线观看影院 | 1000部18未成人禁止国产 | 狠狠色丁香婷婷久久综合2021 | 亚洲综合欧美在线 | 国产欧美在线观看精品一区二区 | 亚洲精品综合一区二区三区 | 精品视频免费 | 久久亚洲综合色 | 色久影院 | 一区二区三区精品国产 | 泄欲网站免费观看 | 国产网站大全 | 91国内外精品自在线播放 | 亚洲啪啪网址 | 国产最爽的乱淫视频国语对 | 国产第二页 | 一级做a爰片久久毛片 | 黄色a视频 | 国产黄在线观看免费观看不卡 | 欧美日韩综合视频 | 99草视频 | 永久视频在线观看 | 一区在线播放 | 日韩在线一区二区 | 8mav模特福利视频在线观看 | 成人自拍视频在线 | 午夜精品久久久久久影视riav | 成人午夜精品久久久久久久小说 | 中国一级毛片免费看视频 | 欧美日韩在线高清 |