文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？

瀏覽：51日期：2022-06-28 18:47:10

問題描述

初學python，在使用scray 爬蟲時，遇到html的特殊字符，于是百度搜看了下文檔：

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示：import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件，看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功，遇到的問題是，return data 這一句，返回數據是無效的？

請問，有沒有就幾句代碼解決轉義的，如果沒有第二種方法里如何才有返回值？

問題解答

回答1：

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’<abc> ’txt = html_parser.unescape(s)print(txt)# 結果：<abc>

Python 編程

上一條：python - Django中如何使用異步下一條：python - ubuntu16.04 lxml的報錯

相關文章：

1. mysql - 怎么生成這個sql表？2. javascript - JS如何取對稱范圍的隨機數？3. 數據庫 - mysql如何處理數據變化中的事務？4. java - ehcache緩存用的是虛擬機內存么？5. 關于docker下的nginx壓力測試6. dockerfile - 我用docker build的時候出現下邊問題麻煩幫我看一下7. docker-machine添加一個已有的docker主機問題8. dockerfile - [docker build image失敗- npm install]9. java - 線上應用，如果數據庫操作失敗的話應該如何處理？10. 使用PHP和MySQL的UNIQUE如何像京東注冊那樣保證用戶名唯一？

排行榜

					
					javascript - JS如何取對稱范圍的隨機數？
mysql - 怎么生成這個sql表？
java - ehcache緩存用的是虛擬機內存么？
數據庫 - mysql如何處理數據變化中的事務？
關于docker下的nginx壓力測試
docker-machine添加一個已有的docker主機問題
dockerfile - [docker build image失敗- npm install]
dockerfile - 我用docker build的時候出現下邊問題  麻煩幫我看一下
ruby - gitlab托管，git clone 失敗？
javascript - vue2如何獲取v-model變量名
html5 - 如何禁用360極速瀏覽器的 瀏覽器內核選擇
				

熱門標簽

亚洲精品久久久中文字幕-亚洲精品久久片久久-亚洲精品久久青草-亚洲精品久久婷婷爱久久婷婷-亚洲精品久久午夜香蕉

python - pythoh3 下 ’&lt;abc&gt;’ 遇到這樣的html轉義符如何自動轉義呢？

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？