亚洲精品久久久中文字幕-亚洲精品久久片久久-亚洲精品久久青草-亚洲精品久久婷婷爱久久婷婷-亚洲精品久久午夜香蕉

您的位置:首頁技術(shù)文章
文章詳情頁

python - 正則表達式匹配html的問題。

瀏覽:74日期:2022-09-05 14:29:29

問題描述

<dd class='gray6'> <span class='gray6'> 中文 <span class='padl27'></span> 中文 </span> 中文內(nèi)容 #需要抓取的內(nèi)容</dd>用BeautifulSoup html.parser解析的網(wǎng)頁,現(xiàn)在用re模塊想抓取**第7行**的中文內(nèi)容,放在一個組里面(.*?)。正則老是匹配不上,用換行符也匹配不上,不知道怎么寫了。。。

問題解答

回答1:

既然你都用bs4解析了,為什么不用它提取哪?bs4內(nèi)有一個stripped_string的函數(shù)正好滿足你的需要。

回答2:

import repattern = re.compile(r’</span>.*?</span>(.*?)</dd>’, re.S)str = ’’’<dd class='gray6'> <span class='gray6'> 中文 <span class='padl27'></span> 中文 </span> 中文內(nèi)容 #需要抓取的內(nèi)容</dd>’’’print(pattern.search(str).group(1))===> 中文內(nèi)容 #需要抓取的內(nèi)容回答3:

const re = /^</span>(.*)</dd>$/

這樣可以不?

標簽: Python 編程
相關(guān)文章:
主站蜘蛛池模板: 欧美成人观看免费完全 | 久久6国产| 日本大片在线观看 | 日本高清xxx | 国产精品公开免费视频 | 国产日韩一区二区三区 | 国产成人18黄网站在线观看网站 | 亚洲最大色视频 | 看一级毛片国产一级毛片 | 国产亚洲一区二区三区在线观看 | 亚洲一区二区三区不卡视频 | 国产成人小视频在线观看 | 久草视频新 | 国产乱人伦精品一区二区 | 国产精品久久久久久久久免费观看 | 国产区视频在线 | 国产色视频网站免费观看 | 久久精彩免费视频 | 成人在线网站 | 一级特黄高清完整大片 | 精品国产香蕉 | 欧美一区二区三区免费看 | 91成人高清在线播放 | 国产小视频在线高清播放 | 每日更新国产 | 欧美精品一区二区三区免费播放 | 亚洲一区二区三区精品影院 | 爆操欧美美女 | 999国产精品999久久久久久 | 在线欧美精品二区三区 | 欧美女交 | 国产精品久久视频 | 亚洲欧美日韩在线2020 | 视频二区在线观看 | 亚洲精品高清在线一区二区三区 | 免费视频精品 | 亚洲欧美中文字幕高清在线一 | 国产国产精品人在线视 | 免费观看日本a毛片 | pans写真福利视频在线 | 国产一区系列在线观看 |