removed templates from googledir example (to keep it DRY) as they made no sense there

--HG--
extra : convert_revision : svn%3Ab85faa78-f9eb-468e-a121-7cced6da292c%401045
This commit is contained in:
Pablo Hoffman 2009-04-10 10:09:51 +00:00
parent d503735bf0
commit 4a2bca83ce
4 changed files with 0 additions and 76 deletions

View File

@ -1,13 +0,0 @@
from scrapy.spider import BaseSpider
class $classname(BaseSpider):
domain_name = "$site"
start_urls = (
'http://www.$site/',
)
def parse(self, response):
return ()
SPIDER = $classname()

View File

@ -1,25 +0,0 @@
# -*- coding: utf8 -*-
import re
from scrapy.xpath import HtmlXPathSelector
from scrapy.link.extractors import RegexLinkExtractor
from scrapy.contrib.spiders import CrawlSpider, Rule
from $project_name.items import ${ProjectName}Item
class $classname(CrawlSpider):
domain_name = '$site'
start_urls = ['http://www.$site/']
rules = (
Rule(RegexLinkExtractor(allow=(r'Items/', )), 'parse_item', follow=True),
)
def parse_item(self, response):
i = ${ProjectName}Item()
#xs = HtmlXPathSelector(response)
#i.attribute('site_id', xs.x('//input[@id="sid"]/@value'))
#i.attribute('name', xs.x('//div[@id="name"]'))
#i.attribute('description', xs.x('//div[@id="description"]'))
return [i]
SPIDER = $classname()

View File

@ -1,22 +0,0 @@
# -*- coding: utf8 -*-
from scrapy.contrib.spiders import CSVFeedSpider
from $project_name.items import ${ProjectName}Item
class $classname(CSVFeedSpider):
domain_name = '$site'
start_urls = ['http://www.$site/feed.csv']
# headers = ['id', 'name', 'description', 'image_link']
# delimiter = '\t'
# Do any adaptations you need here
#def adapt_response(self, response):
# return response
def parse_row(self, response, row):
i = ${ProjectName}Item()
#i.attribute('url', row['url'])
#i.attribute('name', row['name'])
#i.attribute('description', row['description'])
return i
SPIDER = $classname()

View File

@ -1,16 +0,0 @@
# -*- coding: utf8 -*-
from scrapy.contrib.spiders import XMLFeedSpider
from $project_name.items import ${ProjectName}Item
class $classname(XMLFeedSpider):
domain_name = '$site'
start_urls = ['http://www.$site/feed.xml']
def parse_item(self, response, xSel):
i = ${ProjectName}Item()
#i.attribute('url', xSel('url'))
#i.attribute('name', xSel('name'))
#i.attribute('description', xSel('description'))
return i
SPIDER = $classname()