av一区二区在线观看_亚洲男人的天堂网站_日韩亚洲视频_在线成人免费_欧美日韩精品免费观看视频_久草视

您的位置:首頁技術文章
文章詳情頁

xpath - python怎么用lxml處理

瀏覽:100日期:2022-09-22 09:54:52

問題描述

例如:

<p>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒<em><!--red_beg-->aa<!--red_end--></em>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒</p>

就是在p標簽里可能會出現同樣的em標簽,而且數量不定,那我怎么獲取p的內容,包括em里的內容。例如第二個p獲取輸出是‘沒aa沒aa’

或者獲取到p節點之后,怎么把里面的內容轉換為字符串

問題解答

回答1:

今天偶然學到處理這個問題的方法,特意翻出來這個問題回答。題主你可以看一下xpath的軸,比如你要取得第二個<p>標簽的“沒aa沒aa”,實際是取得它全部后代節點的文本內容,可以使用element_dom.xpath('//p[2]//descendant::text()')來取得,拿到的結果是一個這樣[’沒’, ’aa’, ’沒’, ’aa’]的list,然后自己手動拼接成字符串就可以了,比如''.join(list)。同理,如果你需要進行其他操作,也可以使用類似的方法。

回答2:

換bs4,string和text之間的異同就在這里。

回答3:

lxml.html的.text_content()方法,可以獲取當前節點和所有子節點的文本內容。

標簽: Python 編程
相關文章:
主站蜘蛛池模板: www.色综合 | 男女无遮挡xx00动态图120秒 | 免费视频a | 日本在线观看一区 | 日韩毛片视频 | 免费在线观看黄 | 国产在线观看网站 | 伊人免费视频 | 中文字幕av网站 | 亚洲精品中文字幕乱码三区91 | 亚洲国产日韩欧美 | 免费国产视频 | 精品国产欧美一区二区三区成人 | 国产寡妇亲子伦一区二区三区四区 | 久久国产精品99久久人人澡 | 成人在线视频免费观看 | 一级黄色片网站 | 九色91popny蝌蚪新疆 | 国产精品久久久久久久久久久久午夜片 | 亚洲男人av| 国产精品国产三级国产aⅴ浪潮 | 成人午夜网 | 亚洲精品日韩丝袜精品 | 日本午夜精品 | 国产三级在线观看视频 | 国产精品二区一区二区aⅴ污介绍 | 天天看天天爽 | 三级视频在线 | 国产精品二区一区二区aⅴ污介绍 | 天天操夜夜摸 | 日韩免费高清视频 | 国产精品第二页 | 欧美日韩在线一区二区三区 | 黄色片免费观看 | 激情综合色 | 日韩午夜激情 | 这里只有精品视频在线观看 | 日韩一区二区三区四区 | 日韩精品视频在线免费观看 | 天天拍天天干 | 好吊视频一区二区三区四区 |