时间:2021-05-22
代码
# 免费的简历模板进行爬取本地保存 # http://sc.chinaz.com/jianli/free.html# http://sc.chinaz.com/jianli/free_2.htmlimport requestsfrom lxml import etreeimport osdirName = './resumeLibs'if not os.path.exists(dirName): os.mkdir(dirName)headers = { 'User-Agent':'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/85.0.4183.83 Safari/537.36'}url = 'http://sc.chinaz.com/jianli/free_%d.html'for page in range(1,2): if page == 1: new_url = 'http://sc.chinaz.com/jianli/free.html' else: new_url = format(url%page) page_text = requests.get(url=new_url,headers=headers).text tree = etree.HTML(page_text) a_list = tree.xpath('//div[@id="container"]/div/p/a') for a in a_list: a_src = a.xpath('./@href')[0] a_title = a.xpath('./text()')[0] a_title = a_title.encode('iso-8859-1').decode('utf-8') # 爬取下载页面 page_text = requests.get(url=a_src,headers=headers).text tree = etree.HTML(page_text) dl_src = tree.xpath('//div[@id="down"]/div[2]/ul/li[8]/a/@href')[0] resume_data = requests.get(url=dl_src,headers=headers).content resume_name = a_title resume_path = dirName + '/' + resume_name + '.rar' with open(resume_path,'wb') as fp: fp.write(resume_data) print(resume_name,'下载成功!')爬取结果
以上就是python 爬取免费简历模板网站的示例的详细内容,更多关于python 爬取网站的资料请关注其它相关文章!
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
python爬虫-梨视频短视频爬取(线程池)示例代码importrequestsfromlxmlimportetreeimportrandomfrommulti
本文实例讲述了Python实现爬虫爬取NBA数据功能。分享给大家供大家参考,具体如下:爬取的网站为:stat-nba.com,这里爬取的是NBA2016-201
在使用python爬取网站信息时,查看爬取完后的数据发现,数据并没有被爬取下来,这是因为网站中有UA这种请求载体的身份标识,如果不是基于某一款浏览器爬取则是不正
在学习Python爬虫的时候,经常会遇见所要爬取的网站采取了反爬取技术,高强度、高效率地爬取网页信息常常会给网站服务器带来巨大压力,所以同一个IP反复爬取同一个
【个人求职简历模板】简历模板有哪些网站?寻求美丽的个人简历模板?下面就和小编一起来看看吧! 简历模板有哪些网站? 现在有很多简历模板类的网站,上面的信息