文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？

瀏覽：70日期：2022-06-28 18:47:10

問題描述

初學python，在使用scray 爬蟲時，遇到html的特殊字符，于是百度搜看了下文檔：

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示：import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件，看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功，遇到的問題是，return data 這一句，返回數據是無效的？

請問，有沒有就幾句代碼解決轉義的，如果沒有第二種方法里如何才有返回值？

問題解答

回答1：

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’<abc> ’txt = html_parser.unescape(s)print(txt)# 結果：<abc>

Python 編程

上一條：python - Django中如何使用異步下一條：python - ubuntu16.04 lxml的報錯

相關文章：

1. angular.js - angular內容過長展開收起效果2. 關于nginx location配置的問題，root到底是什么3. 關于docker下的nginx壓力測試4. angular.js - angularjs的自定義過濾器如何給文字加顏色？5. docker鏡像push報錯6. python - flask表單如何把提交多行數據在服務端讀取出來？7. python 怎樣用pickle保存類的實例？8. 并發模型 - python將進程池放在裝飾器里為什么不生效也沒報錯9. python的前景到底有大？如果不考慮數據挖掘，機器學習這塊？10. 大家好，請問在python腳本中怎么用virtualenv激活指定的環境？

排行榜

					
					關于docker下的nginx壓力測試
docker鏡像push報錯
angular.js - angular內容過長展開收起效果
angular.js - angularjs的自定義過濾器如何給文字加顏色？
關于nginx  location配置的問題，root到底是什么
javascript - 如何讓移動端網頁的輸入框固定在底部？
java - 請教一個spring定時任務的問題
codeigniter本地引用Bootstrap樣式不生效
javascript - 關于emoji是如何解析的呢？？
在windows下安裝docker  Toolbox 啟動Docker Quickstart Terminal 失敗！
docker-machine添加一個已有的docker主機問題
				

熱門標簽

国产成人精品久久免费动漫-国产成人精品天堂-国产成人精品区在线观看-国产成人精品日本-a级毛片无码免费真人-a级毛片毛片免费观看久潮喷

python - pythoh3 下 ’&lt;abc&gt;’ 遇到這樣的html轉義符如何自動轉義呢？

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？