scrapy创建新项目注意事项

本文详细介绍了如何使用Scrapy框架从零开始搭建一个爬虫项目,包括创建项目、生成爬虫及基本目录结构解析等内容,是初学者快速上手Scrapy的理想教程。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

1、在开始爬取之前,您必须创建一个新的Scrapy项目。 进入您打算存储代码的目录中,运行下列命令:

scrapy startproject tutorial

2、该命令将会创建包含下列内容的 tutorial 目录: tree

tutorial/
    scrapy.cfg
    tutorial/
        __init__.py
        items.py
        pipelines.py
        settings.py
        spiders/
            __init__.py
            ...

这些文件分别是:

  • scrapy.cfg: 项目的配置文件
  • tutorial/: 该项目的python模块。之后您将在此加入代码。
  • tutorial/items.py: 项目中的item文件.
  • tutorial/pipelines.py: 项目中的pipelines文件.
  • tutorial/settings.py: 项目的设置文件.
  • tutorial/spiders/: 放置spider代码的目录.

3、

cd tutorial 之后先 scrapy genspider dmoz dmoz.org, 然后再scrapy crawl dmoz

注意目录路径为:

第一步的执行路径为.\Anaconda3\Scripts\tutorial

第二步的执行路径不变。

否则会报错执行不通。

之后就可以自主的编辑项目的spider和pipelines

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值