使用Python的urllib和urllib2模块制作爬虫的实例教程

时间：2021-05-22

urllib
学习python完基础,有些迷茫.眼睛一闭,一种空白的窒息源源不断而来.还是缺少练习,遂拿爬虫来练练手.学习完斯巴达python爬虫课程后,将心得整理如下,供后续翻看.整篇笔记主要分以下几个部分:

1.做一个简单的爬虫程序
2.小试牛刀--抓取百度贴吧图片
3.总结

1.做一个简单的爬虫程序
首先环境描述

Device: Mba 2012 Yosemite 10.10.1
Python: python 2.7.9
编辑器: Sublime Text 3

这个没有什么好说的,直接上代码吧!

'''@ urllib为python自带的一个网络库@ urlopen为urllib的一个方法,用于打开一个连接并抓取网页, 然后通过read()方法把值赋给read()'''import urlliburl = "http://patible; MSIE 9.0; Windows NT 6.1; WOW64; Trident/5.0; Sleipnir/2.9.8)', #因篇幅关系,此处省略N条]random_header = random.choice(headers)# 可以通过print random_header查看提交的header信息req = urllib2.Request(url)req.add_header("User-Agent", random_header)req.add_header('Host', 'blog.csdn.net')req.add_header('Referer', 'http://blog.csdn.net')req.add_header('GET', url)content = urllib2.urlopen(req).read()print content

其实很简单,这样我们就完成了对代码的一些优化.

声明：本页内容来源网络，仅供用户参考；我单位不保证亦不表示资料全面及准确无误，也不保证亦不表示这些资料为最新信息，如因任何原因，本网内容或者用户因倚赖本网内容造成任何损失或损害，我单位将不会负任何法律责任。如涉及版权问题，请提交至online#300.cn邮箱联系删除。

使用Python的urllib和urllib2模块制作爬虫的实例教程

相关文章

Python中使用urllib2模块编写爬虫的简单上手示例

使用Python编写爬虫的基本模块及框架使用指南

python爬虫基础之urllib的使用

Python实现的爬虫功能代码

python 网络爬虫初级实现代码