国产成人精品久久免费动漫-国产成人精品天堂-国产成人精品区在线观看-国产成人精品日本-a级毛片无码免费真人-a级毛片毛片免费观看久潮喷

您的位置:首頁技術(shù)文章
文章詳情頁

python - 如何解決scarpy-redis空跑問題?

瀏覽:89日期:2022-06-25 16:52:42

問題描述

scrapy-redis框架中,reids存儲的xxx:requests已經(jīng)爬取完畢,但程序仍然一直運(yùn)行,如何自動(dòng)停止程序,而不是一直在空跑?

2017-07-03 09:17:06 [scrapy.extensions.logstats] INFO: Crawled 0 pages (at 0 pages/min), scraped 0 items (at 0 items/min)2017-07-03 09:18:06 [scrapy.extensions.logstats] INFO: Crawled 0 pages (at 0 pages/min), scraped 0 items (at 0 items/min)

可以通過engine.close_spider(spider, ’reason’)來停止程序的運(yùn)行。

def next_request(self):block_pop_timeout = self.idle_before_closerequest = self.queue.pop(block_pop_timeout)if request and self.stats: self.stats.inc_value(’scheduler/dequeued/redis’, spider=self.spider)if request is None: self.spider.crawler.engine.close_spider(self.spider, ’queue is empty’)return request

還有一個(gè)問題不明白:當(dāng)通過engine.close_spider(spider, ’reason’)來關(guān)閉spider時(shí),會(huì)出現(xiàn)幾個(gè)錯(cuò)誤之后才能關(guān)閉。

# 正常關(guān)閉2017-07-03 18:02:38 [scrapy.core.engine] INFO: Closing spider (queue is empty)2017-07-03 18:02:38 [scrapy.statscollectors] INFO: Dumping Scrapy stats:{’finish_reason’: ’queue is empty’, ’finish_time’: datetime.datetime(2017, 7, 3, 10, 2, 38, 616021), ’log_count/INFO’: 8, ’start_time’: datetime.datetime(2017, 7, 3, 10, 2, 38, 600382)}2017-07-03 18:02:38 [scrapy.core.engine] INFO: Spider closed (queue is empty)# 之后還會(huì)出現(xiàn)幾個(gè)錯(cuò)誤才關(guān)閉spider,難道spider剛啟動(dòng)時(shí)會(huì)啟動(dòng)多個(gè)線程一起抓取, # 然后其中一個(gè)線程關(guān)閉了spider,其他線程就找不到spider才會(huì)報(bào)錯(cuò)!Unhandled ErrorTraceback (most recent call last): File 'D:/papp/project/launch.py', line 37, in <module> process.start() File 'D:Program Filespython3libsite-packagesscrapycrawler.py', line 285, in start reactor.run(installSignalHandlers=False) # blocking call File 'D:Program Filespython3libsite-packagestwistedinternetbase.py', line 1243, in run self.mainLoop() File 'D:Program Filespython3libsite-packagestwistedinternetbase.py', line 1252, in mainLoop self.runUntilCurrent()--- <exception caught here> --- File 'D:Program Filespython3libsite-packagestwistedinternetbase.py', line 878, in runUntilCurrent call.func(*call.args, **call.kw) File 'D:Program Filespython3libsite-packagesscrapyutilsreactor.py', line 41, in __call__ return self._func(*self._a, **self._kw) File 'D:Program Filespython3libsite-packagesscrapycoreengine.py', line 137, in _next_request if self.spider_is_idle(spider) and slot.close_if_idle: File 'D:Program Filespython3libsite-packagesscrapycoreengine.py', line 189, in spider_is_idle if self.slot.start_requests is not None:builtins.AttributeError: ’NoneType’ object has no attribute ’start_requests’

問題解答

回答1:

怎樣知道放的requests爬取完畢,這個(gè)要定義才知道如果不復(fù)雜,可以使用內(nèi)部擴(kuò)展關(guān)掉!

scrapy.contrib.closespider.CloseSpider

CLOSESPIDER_TIMEOUTCLOSESPIDER_ITEMCOUNTCLOSESPIDER_PAGECOUNTCLOSESPIDER_ERRORCOUNThttp://scrapy-chs.readthedocs...

標(biāo)簽: Python 編程
相關(guān)文章:
主站蜘蛛池模板: 又www又黄又爽啪啪网站 | 奇米888四色在线精品 | 日韩欧美在线视频 | 99视频在线观看免费 | 精品国产91久久久久久久a | 欧美日韩一区在线观看 | 在线播放亚洲视频 | 播播网手机在线播放 | 国产日韩欧美一区二区 | 午夜爽爽视频 | 青青草国产一区二区三区 | 亚洲精品国自产拍影院 | 国产成人精品视频一区 | 国内自拍2020 | 日韩午夜在线观看 | 特黄特黄aaaa级毛片免费看 | 久久亚洲精品永久网站 | 三级c欧美做人爱视频 | 中文字幕 亚洲 一区二区三区 | 久久久精品久久久久三级 | 18免费视频| 美国一级做a一级视频 | 在线观看中文字幕亚洲 | 亚洲在线观看免费视频 | 欧美视频精品一区二区三区 | 免费毛片a线观看 | 成人精品在线视频 | 国产三级精品久久三级国专区 | 久久国产精品免费看 | 久久综合久久美利坚合众国 | se94se最新网站 | 精品在线视频播放 | 久久女同互慰一区二区三区 | 国产成人一区二区在线不卡 | 色综合夜夜嗨亚洲一二区 | 九九99视频在线观看视频观看 | 国产一区二区三区免费视频 | 亚洲综合成人网在线观看 | 欧美国产成人一区二区三区 | 国产精品分类视频分类一区 | 天天做天天爱夜夜大爽完整 |