From b6a200d02a503c719f7880c3946f77813d82e0c5 Mon Sep 17 00:00:00 2001 From: nyov Date: Fri, 6 Dec 2013 20:48:25 +0000 Subject: [PATCH] Update CrawlSpider Template with Selector changes --- scrapy/templates/spiders/crawl.tmpl | 10 +++++----- 1 file changed, 5 insertions(+), 5 deletions(-) diff --git a/scrapy/templates/spiders/crawl.tmpl b/scrapy/templates/spiders/crawl.tmpl index c6d0ab9f7..82c27d7f4 100644 --- a/scrapy/templates/spiders/crawl.tmpl +++ b/scrapy/templates/spiders/crawl.tmpl @@ -1,4 +1,4 @@ -from scrapy.selector import HtmlXPathSelector +from scrapy.selector import Selector from scrapy.contrib.linkextractors.sgml import SgmlLinkExtractor from scrapy.contrib.spiders import CrawlSpider, Rule from $project_name.items import ${ProjectName}Item @@ -13,9 +13,9 @@ class $classname(CrawlSpider): ) def parse_item(self, response): - hxs = HtmlXPathSelector(response) + sel = Selector(response) i = ${ProjectName}Item() - #i['domain_id'] = hxs.select('//input[@id="sid"]/@value').extract() - #i['name'] = hxs.select('//div[@id="name"]').extract() - #i['description'] = hxs.select('//div[@id="description"]').extract() + #i['domain_id'] = sel.xpath('//input[@id="sid"]/@value').extract() + #i['name'] = sel.xpath('//div[@id="name"]').extract() + #i['description'] = sel.xpath('//div[@id="description"]').extract() return i