宜配屋

Pycharm+Scrapy安装并且初始化项目的方法

yipeiwu_com6年前 (2020-03-06)Python基础

前言

Scrapy是一个开源的网络爬虫框架，Python编写的。最初设计用于网页抓取，也可以用来提取数据使用API或作为一个通用的网络爬虫。是数据采集不可必备的利器。

安装

pip install scrapy

如果使用上面的命令太慢。国内可以使用豆瓣源进行加速。

pip install -i https://pypi.douban.com/simple scrapy

注意要写错了，是 https://pypi.douban.com/simple 很多包都可以使用这个源进行加速，这也是pip的一个技巧，还可以使用阿里云进行加速。

安装完成之后在命令行输入

scrapy -v

如果出现了相应的版本号就说明安装成功。

创建项目

目前还没有IDE 能够创建scrapy的项目，我们必须手动初始化项目。

1、找一个目录

输入命令

scrapy startproject SpiderObject

命令行出现这样的结果说明创建成果

You can start your first spider with:
 cd SpiderObject
 scrapy genspider example example.com

去文件夹中看看

Pycharm+Scrapy安装并且初始化项目

初始化项目

使用pycharm打开该项目

Pycharm+Scrapy安装并且初始化项目

如果出现这个页面就说明对了。

Pycharm+Scrapy安装并且初始化项目

下面生成一个模板

打开pycharm的terminal

Pycharm+Scrapy安装并且初始化项目

输入

scrapy genspider BiduSpider http://www.baidu.com

我们的spider 包下面会多一个文件

Pycharm+Scrapy安装并且初始化项目

这说明我们的spider创建成功。可以在pytharm中使用这个强大的框架了。

以上这篇Pycharm+Scrapy安装并且初始化项目的方法就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持【听图阁-专注于Python设计】。

Pycharm+Scrapy安装并且初始化项目的方法

相关文章

正确理解python中的关键字“with”与上下文管理器

Python实现通过文件路径获取文件hash值的方法

打印出python 当前全局变量和入口参数的所有属性

python多进程读图提取特征存npy

Python timeit模块的使用实践

© YiPeiWu.com 【宜配屋】粤ICP备17031333号

Powered By Z-BlogPHP. Theme by TOYEAN.

宜配屋

Pycharm+Scrapy安装并且初始化项目的方法

相关文章

正确理解python中的关键字“with”与上下文管理器

Python实现通过文件路径获取文件hash值的方法

打印出python 当前全局变量和入口参数的所有属性

python多进程读图提取特征存npy

Python timeit模块的使用实践

© YiPeiWu.com 【宜配屋】 粤ICP备17031333号 var _hmt = _hmt || [];(function() { var hm = document.createElement("script"); hm.src = "https://hm.baidu.com/hm.js?8aa60ae04b767b2af31903508928acc0"; var s = document.getElementsByTagName("script")[0]; s.parentNode.insertBefore(hm, s);})();

Powered By Z-BlogPHP. Theme by TOYEAN.

© YiPeiWu.com 【宜配屋】粤ICP备17031333号