亚洲精品久久久中文字幕-亚洲精品久久片久久-亚洲精品久久青草-亚洲精品久久婷婷爱久久婷婷-亚洲精品久久午夜香蕉

您的位置:首頁技術(shù)文章
文章詳情頁

python - 正則表達(dá)式匹配html的問題。

瀏覽:57日期:2022-09-05 14:29:29

問題描述

<dd class='gray6'> <span class='gray6'> 中文 <span class='padl27'></span> 中文 </span> 中文內(nèi)容 #需要抓取的內(nèi)容</dd>用BeautifulSoup html.parser解析的網(wǎng)頁,現(xiàn)在用re模塊想抓取**第7行**的中文內(nèi)容,放在一個(gè)組里面(.*?)。正則老是匹配不上,用換行符也匹配不上,不知道怎么寫了。。。

問題解答

回答1:

既然你都用bs4解析了,為什么不用它提取哪?bs4內(nèi)有一個(gè)stripped_string的函數(shù)正好滿足你的需要。

回答2:

import repattern = re.compile(r’</span>.*?</span>(.*?)</dd>’, re.S)str = ’’’<dd class='gray6'> <span class='gray6'> 中文 <span class='padl27'></span> 中文 </span> 中文內(nèi)容 #需要抓取的內(nèi)容</dd>’’’print(pattern.search(str).group(1))===> 中文內(nèi)容 #需要抓取的內(nèi)容回答3:

const re = /^</span>(.*)</dd>$/

這樣可以不?

標(biāo)簽: Python 編程
相關(guān)文章:
主站蜘蛛池模板: 国产大片免费观看网站 | 久久88香港三级 | 亚洲国产精品美女 | 久久亚洲国产成人精品性色 | 国产一区二区三区国产精品 | 亚洲欧美国产五月天综合 | 91大神大战丝袜美女在线观看 | 免费无限制观看黄的网址 | 亚洲黄色免费观看 | 91精品久久久久含羞草 | 狠狠综合久久久久综合小说网 | 亚在线 | 国产无圣光高清一区二区 | 国产精品免费视频一区二区 | 久久777 | 亚洲一区二区三区高清网 | 国产伦子一区二区三区四区 | 国产理论最新国产精品视频 | 精彩视频一区二区 | 亚洲第一区精品日韩在线播放 | 免费国产成高清人在线视频 | 日本在线看片网站 | 欧美在线观看成人高清视频 | 亚洲成人一区 | 一区二区三区视频在线 | 小泽玛利亚一区二区在线看 | 亚洲色图35p | 国产精品欧美亚洲日本综合 | 欧美视频免费在线播放 | 欧美综合中文字幕久久 | 99国产国人青青视频在线观看 | 亚洲综合区| 4444在线网站 | 久久99精品久久久久久久不卡 | 两个人做人爱视频免费 | 亚洲综合日韩欧美一区二区三 | 国产精品亚洲综合网站 | 久久只有精品 | 97精品视频在线 | 特黄特色大片免费视频播放 | 国产亚洲一区二区精品 |