文章詳情頁

python 爬取免費簡歷模板網站的示例

瀏覽：4日期：2022-07-09 17:14:52

代碼

# 免費的簡歷模板進行爬取本地保存 # http://sc.chinaz.com/jianli/free.html# http://sc.chinaz.com/jianli/free_2.htmlimport requestsfrom lxml import etreeimport osdirName = ’./resumeLibs’if not os.path.exists(dirName): os.mkdir(dirName)headers = { ’User-Agent’:’Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/85.0.4183.83 Safari/537.36’}url = ’http://sc.chinaz.com/jianli/free_%d.html’for page in range(1,2): if page == 1: new_url = ’http://sc.chinaz.com/jianli/free.html’ else: new_url = format(url%page) page_text = requests.get(url=new_url,headers=headers).text tree = etree.HTML(page_text) a_list = tree.xpath(’//div[@id='container']/div/p/a’) for a in a_list: a_src = a.xpath(’./@href’)[0] a_title = a.xpath(’./text()’)[0] a_title = a_title.encode(’iso-8859-1’).decode(’utf-8’) # 爬取下載頁面 page_text = requests.get(url=a_src,headers=headers).text tree = etree.HTML(page_text) dl_src = tree.xpath(’//div[@id='down']/div[2]/ul/li[8]/a/@href’)[0]resume_data = requests.get(url=dl_src,headers=headers).content resume_name = a_title resume_path = dirName + ’/’ + resume_name + ’.rar’ with open(resume_path,’wb’) as fp: fp.write(resume_data) print(resume_name,’下載成功!’)

以上就是python 爬取免費簡歷模板網站的示例的詳細內容，更多關于python 爬取網站的資料請關注好吧啦網其它相關文章！

Python 編程

上一條：Python日志器使用方法及原理解析下一條：python如何提升爬蟲效率

相關文章：

1. XML入門的常見問題(四)2. HTML5 Canvas繪制圖形從入門到精通3. ASP基礎知識VBScript基本元素講解4. 利用CSS3新特性創建透明邊框三角5. asp(vbscript)中自定義函數的默認參數實現代碼6. 使用Spry輕松將XML數據顯示到HTML頁的方法7. 詳解CSS偽元素的妙用單標簽之美8. JSP的Cookie在登錄中的使用9. XHTML 1.0：標記新的開端10. PHP設計模式中工廠模式深入詳解

排行榜

					
					IDEA Git Stash 使用詳解
IntelliJ IDEA配置Tomcat服務器的方法
IntelliJ IDEA 統一設置編碼為utf-8編碼的實現
npm下載慢或下載失敗問題解決的三種方法
Docker開啟遠程安全訪問的圖文教程詳解
android studio xml文件實現添加注釋
利用CSS3新特性創建透明邊框三角
python selenium 獲取接口數據的實現
Docker容器沒有權限寫入宿主機目錄的解決方案
php strncmp函數原型源碼分析
詳解CSS偽元素的妙用單標簽之美