三个python爬虫项目实例代码

时间：2021-05-22

这篇文章主要介绍了三个python爬虫项目实例代码,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下

爬取内涵段子：

#encoding=utf-8import urllib2import reclass neihanba(): def spider(self): ''' 爬虫的主调度器 ''' isflow=True#判断是否进行下一页 page=1 while isflow: url="http://pile(r'<a\s+rel="noreferrer"\s+href="/p/\d+" rel="external nofollow" \s+title=".*?"\s+target="_blank" class="j_th_tit\s+">(.*?)</a>',re.S) titleList=partten.findall(html) rstr=r'<span\s+class="topic-tag"\s+data-name=".*?">#(.*?)#</span>' for title in titleList: title=re.sub(rstr,"",title) self.writePage(title,page) def writePage(self,context,page): fileName="di"+str(page)+"yehtml.txt" with open(fileName,"a") as file: file.writelines(context+"\n")if __name__ == '__main__': name=raw_input("请输入贴吧名：") startPage=raw_input("请输入起始页：") endPage=raw_input("请输入终止页：") t=teiba() t.spider(name,int(startPage),int(endPage))

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

声明：本页内容来源网络，仅供用户参考；我单位不保证亦不表示资料全面及准确无误，也不保证亦不表示这些资料为最新信息，如因任何原因，本网内容或者用户因倚赖本网内容造成任何损失或损害，我单位将不会负任何法律责任。如涉及版权问题，请提交至online#300.cn邮箱联系删除。

三个python爬虫项目实例代码

相关文章

Android SeekBar实现平滑滚动

Python爬虫DNS解析缓存方法实例分析

python3第三方爬虫库BeautifulSoup4安装教程

python 判断三个数字中的最大值实例代码

python爬虫爬取某站上海租房图片