时间:2021-05-22
本文实例讲述了Python简单实现网页内容抓取功能。分享给大家供大家参考,具体如下:
使用模块:
import urllib2 import urllib普通抓取实例:
#!/usr/bin/python# -*- coding: UTF-8 -*-import urllib2url = 'http:///s?wd=%E8%BD%A6%E4%BA%91#创建request对象request = urllib2.Request(url)#发送请求,获取结果try: response = urllib2.urlopen(request)except BaseException, err: print err exit()#获取状态码,如果是200表示获取成功code = response.getcode()print code#读取内容if 200 == code: content = response.read() print content更多关于Python相关内容可查看本站专题:《Python Socket编程技巧总结》、《Python正则表达式用法总结》、《Python数据结构与算法教程》、《Python函数使用技巧总结》、《Python字符串操作技巧汇总》、《Python入门与进阶经典教程》及《Python文件与目录操作技巧汇总》
希望本文所述对大家Python程序设计有所帮助。
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
python爬虫模块BeautifulSoup简介简单来说,BeautifulSoup是python的一个库,最主要的功能是从网页抓取数据。官方解释如下:Bea
Node.JS有一个request模块,可以很方便的抓取网页内容。最简单的一个示例:varrequest=require('request');request(
简介今天试着用ptyhon做了一个抓取网页内容,并生成word文档的功能,功能很简单,做一下记录以备以后用到。生成word用到了第三方组件python-docx
在web开发的时候我们经常会遇到网页抓取和分析,各种语言都可以完成这个功能。我喜欢用python实现,因为python提供了很多成熟的模块,可以很方便的实现网页
本文实例讲述了python基于BeautifulSoup实现抓取网页指定内容的方法。分享给大家供大家参考。具体实现方法如下:#_*_coding:utf-8_*