久久r热视频,国产午夜精品一区二区三区视频,亚洲精品自拍偷拍,欧美日韩精品二区

您的位置:首頁技術文章
文章詳情頁

python - 正則表達式匹配html的問題。

瀏覽:96日期:2022-09-05 14:29:29

問題描述

<dd class='gray6'> <span class='gray6'> 中文 <span class='padl27'></span> 中文 </span> 中文內容 #需要抓取的內容</dd>用BeautifulSoup html.parser解析的網頁,現在用re模塊想抓取**第7行**的中文內容,放在一個組里面(.*?)。正則老是匹配不上,用換行符也匹配不上,不知道怎么寫了。。。

問題解答

回答1:

既然你都用bs4解析了,為什么不用它提取哪?bs4內有一個stripped_string的函數正好滿足你的需要。

回答2:

import repattern = re.compile(r’</span>.*?</span>(.*?)</dd>’, re.S)str = ’’’<dd class='gray6'> <span class='gray6'> 中文 <span class='padl27'></span> 中文 </span> 中文內容 #需要抓取的內容</dd>’’’print(pattern.search(str).group(1))===> 中文內容 #需要抓取的內容回答3:

const re = /^</span>(.*)</dd>$/

這樣可以不?

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 崇州市| 息烽县| 岳普湖县| 荔浦县| 泾源县| 平阳县| 麻城市| 明水县| 浦北县| 额济纳旗| 尖扎县| 永修县| 瑞丽市| 介休市| 莱州市| 巴中市| 离岛区| 闽清县| 古丈县| 麦盖提县| 平和县| 肇东市| 舞钢市| 兴义市| 祁连县| 三原县| 江城| 保亭| 和顺县| 渭源县| 昌吉市| 尼玛县| 砚山县| 宜章县| 丹江口市| 永康市| 元氏县| 璧山县| 三门县| 凌云县| 九台市|