色综合图-色综合图片-色综合图片二区150p-色综合图区-玖玖国产精品视频-玖玖香蕉视频

您的位置:首頁技術文章
文章詳情頁

xpath - python怎么用lxml處理

瀏覽:82日期:2022-09-22 09:54:52

問題描述

例如:

<p>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒<em><!--red_beg-->aa<!--red_end--></em>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒</p>

就是在p標簽里可能會出現同樣的em標簽,而且數量不定,那我怎么獲取p的內容,包括em里的內容。例如第二個p獲取輸出是‘沒aa沒aa’

或者獲取到p節點之后,怎么把里面的內容轉換為字符串

問題解答

回答1:

今天偶然學到處理這個問題的方法,特意翻出來這個問題回答。題主你可以看一下xpath的軸,比如你要取得第二個<p>標簽的“沒aa沒aa”,實際是取得它全部后代節點的文本內容,可以使用element_dom.xpath('//p[2]//descendant::text()')來取得,拿到的結果是一個這樣[’沒’, ’aa’, ’沒’, ’aa’]的list,然后自己手動拼接成字符串就可以了,比如''.join(list)。同理,如果你需要進行其他操作,也可以使用類似的方法。

回答2:

換bs4,string和text之間的異同就在這里。

回答3:

lxml.html的.text_content()方法,可以獲取當前節點和所有子節點的文本內容。

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 国产日比视频 | 日本手机看片 | 国产三级小视频在线观看 | 日本不卡一区在线 | 亚洲天堂一区在线 | 特级毛片a级毛免费播放 | 久久91亚洲精品中文字幕奶水 | 蜜臀91精品国产高清在线观看 | 美女张开腿让男生桶出水 | 一级aaaaa毛片免费视频 | 午夜久久久久久久 | 日韩一区二区不卡中文字幕 | 自拍 欧美 | 国产色在线播放 | 一级黄色香蕉视频 | 超级香蕉97视频在线观看一区 | 99热热久久这里只有精品166 | 成年女人免费看片 | 狠狠色狠狠色综合久久第一次 | 国产精品毛片在线大全 | 在线观看中文字幕国产 | 国产欧美日韩高清专区手机版 | 全部孕妇毛片丰满孕妇孕交 | 久久久久免费 | 欧美成人自拍 | 亚洲爱爱天堂 | 国产亚洲精品激情一区二区三区 | 成 人免费视频l免费观看 | 在线亚洲精品中文字幕美乳 | 欧美三级一级 | 国产精品99久久久 | 亚洲成人在线播放 | 日韩专区欧美 | 亚洲看片 | 国产精品7m凸凹视频分类大全 | 波多野结衣一区二区三区88 | 久久精品成人 | 欧美日韩高清在线观看一区二区 | 日韩免费观看一级毛片看看 | 国产欧美另类性视频 | 亚洲日本在线看片 |