爬虫练习_使用scrapy爬取淘宝

2019年6月11日 605次阅读来源: zhongxin钟

使用爬虫框架scrapy爬取淘宝

一.创建项目

1.安装scrapy

pip install scrapy

2.选择一个目录开启一个scrapy项目

scrapy startproject taobao

3.新建一个名为mytaobao的爬虫

scrapy genspider mytaobao taobao.com

《爬虫练习_使用scrapy爬取淘宝》

二.制定需要的内容

从web端找到几项内容

《爬虫练习_使用scrapy爬取淘宝》关注的内容

价格

收货人数

商品名

商铺名

发货地址

详情连接

将内容写入items.py

根据提示开始写

# define the fields for your item here like:

# name = scrapy.Field()

  class TaobaoItem(scrapy.Item):
      price = scrapy.Field()
      sales = scrapy.Field()
      title = scrapy.Field()
      nick = scrapy.Field()
      loc = scrapy.Field()
      detail_url = scrapy.Field()

开启setting.py中的item配置

《爬虫练习_使用scrapy爬取淘宝》

三.分析url

淘宝搜索

女装裙

且按销量排序后的url为：

https://s.taobao.com/search?q=%E5%A5%B3%E8%A3%85+%E8%A3%99&imgfile=&js=1&stats_click=search_radio_all%3A1&initiative_id=staobaoz_20180406&ie=utf8&sort=sale-desc

大胆的删除一些看上去没啥用的内容