时间:2021-05-22
前言
Scrapy是一个开源的网络爬虫框架,Python编写的。最初设计用于网页抓取,也可以用来提取数据使用API或作为一个通用的网络爬虫。是数据采集不可必备的利器。
安装
pip install scrapy如果使用上面的命令太慢。国内可以使用豆瓣源进行加速。
pip install -i https://pypi.douban.com/simple scrapy注意要写错了,是 https://pypi.douban.com/simple 很多包都可以使用这个源进行加速,这也是pip的一个技巧,还可以使用阿里云进行加速。
安装完成之后在命令行输入
scrapy -v如果出现了相应的版本号就说明安装成功。
创建项目
目前还没有IDE 能够创建scrapy的项目,我们必须手动初始化项目。
1、找一个目录
输入命令
scrapy startproject SpiderObject命令行出现这样的结果说明创建成果
You can start your first spider with: cd SpiderObject scrapy genspider example example.com去文件夹中看看
初始化项目
使用pycharm打开该项目
如果出现这个页面就说明对了。
下面生成一个模板
打开pycharm的terminal
输入
scrapy genspider BiduSpider http://我们的spider 包下面会多一个文件
这说明我们的spider创建成功。可以在pytharm中使用这个 强大的框架了。
以上这篇Pycharm+Scrapy安装并且初始化项目的方法就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持。
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
第一步、基础环境初始化项目初始化npminit-y安装webpacknpmiwebpack安装reactnpmireactreact-dom-s项目基础框架入口
1、搭建项目框架npm初始化项目npminit-y //按默认配置初始化项目安装需要的第三方库npminstallbootstrapangularangula
首先,整个项目的创建命令:npmiegg-init-g//安装eggegg-initegg-example--type=simple//初始化一个egg模板例子
一、安装seleniumpipinstallSelenium二、初始化浏览器Chrome是初始化谷歌浏览器Firefox是初始化火狐浏览器Edge是初始化IE浏
一:npm初始化如果你的小程序项目没有安装过npm包的话,你需要先初始化npmnpminit二:安装npm包这里以vant-weapp(小程序UI组件库)为例: