文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？

瀏覽：73日期：2022-06-28 18:47:10

問題描述

初學python，在使用scray 爬蟲時，遇到html的特殊字符，于是百度搜看了下文檔：

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示：import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件，看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功，遇到的問題是，return data 這一句，返回數據是無效的？

請問，有沒有就幾句代碼解決轉義的，如果沒有第二種方法里如何才有返回值？

問題解答

回答1：

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’<abc> ’txt = html_parser.unescape(s)print(txt)# 結果：<abc>

Python 編程

上一條：python - Django中如何使用異步下一條：python - ubuntu16.04 lxml的報錯

相關文章：

1. mysql - sql 左連接結果union右連接結果，導致重復性計算怎么解決？2. 數組排序，并把排序后的值存入到新數組中3. 默認輸出類型為json，如何輸出html4. mysql 遠程連接出錯10060，我已經設置了任意主機了。。。5. mysql怎么表示兩個字段的差6. MySQL的聯合查詢[union]有什么實際的用處7. mysql時間格式問題8. php多任務倒計時求助9. mysql的主從復制、讀寫分離，關于從的問題10. PHP訂單派單系統

排行榜

					
					javascript - webpack打包出現react-dom相關錯誤
android - 能夠自定義安卓webview的內核版本嗎
怎么能做出標簽切換頁的效果，（文字內容隨動）
這種功能前端是如何實現?
python - 安裝anaconda2出錯
html - 爬蟲時出現“DNS lookup failed”，打開網頁卻沒問題，這是什么情況？
vue.js - vue獲取mongodb中的數據起初顯示未定義，但還是可以渲染
mac連接阿里云docker集群，已經卡了2天了，求問？
angular.js - angular-ui-bootstrap 報錯無法使用？
javascript - 如何讓手機端的代碼只能在手機端執行，在pc端的模擬器里面也不執行
docker pull 錯誤？
				

熱門標簽

亚洲免费在线视频-亚洲啊v-久久免费精品视频-国产精品va-看片地址-成人在线视频网

python - pythoh3 下 ’&lt;abc&gt;’ 遇到這樣的html轉義符如何自動轉義呢？

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？