亚洲精品久久久中文字幕-亚洲精品久久片久久-亚洲精品久久青草-亚洲精品久久婷婷爱久久婷婷-亚洲精品久久午夜香蕉

您的位置:首頁技術文章
文章詳情頁

xpath - python怎么用lxml處理

瀏覽:62日期:2022-09-22 09:54:52

問題描述

例如:

<p>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒<em><!--red_beg-->aa<!--red_end--></em>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒</p>

就是在p標簽里可能會出現同樣的em標簽,而且數量不定,那我怎么獲取p的內容,包括em里的內容。例如第二個p獲取輸出是‘沒aa沒aa’

或者獲取到p節點之后,怎么把里面的內容轉換為字符串

問題解答

回答1:

今天偶然學到處理這個問題的方法,特意翻出來這個問題回答。題主你可以看一下xpath的軸,比如你要取得第二個<p>標簽的“沒aa沒aa”,實際是取得它全部后代節點的文本內容,可以使用element_dom.xpath('//p[2]//descendant::text()')來取得,拿到的結果是一個這樣[’沒’, ’aa’, ’沒’, ’aa’]的list,然后自己手動拼接成字符串就可以了,比如''.join(list)。同理,如果你需要進行其他操作,也可以使用類似的方法。

回答2:

換bs4,string和text之間的異同就在這里。

回答3:

lxml.html的.text_content()方法,可以獲取當前節點和所有子節點的文本內容。

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 91亚洲国产在人线播放午夜 | 国产精品你懂的在线播放 | 九七在线视频 | 麻豆国产高清在线播放 | 女人一级一级毛片 | 亚洲一区二区三区四 | 日韩欧美亚洲综合 | 日韩做爰在线观看免费 | 亚洲国产午夜 | 69日本人xxxxx成熟98 | 亚洲国产成人精品激情 | 日韩在线操| 国产精品jizz在线观看软件 | 亚洲精品福利视频 | 亚洲精彩视频 | 亚洲伊人精品综合在合线 | 国产又色又爽又黄的网站在线一级 | 亚洲第五色综合网 | 国产欧美一区二区三区在线看 | 日本高清在线不卡 | 日韩一区二区三区在线视频 | 99国产在线观看 | 中国一级簧色 | 婷婷丁香啪啪 | 十级毛片| 欧美特级黄色录像 | 国产成人在线播放视频 | 日本免费看片在线播放 | 日韩精品一区二区三区免费视频 | 国产1区在线观看 | 色综合久久精品中文字幕 | 亚洲成a人片在线观看播放 亚洲成a人片在线播放观看国产 | 国产一区二区视频免费 | 黄色三级三级三级免费看 | 成年轻人在线看片 | 亚洲精品第一国产综合高清 | 日韩精品久久久久久 | 久久er热这里只有精品免费 | 国产美女亚洲精品久久久毛片 | 网红毛片 | 在线观看免费精品国自产 |