我正在尝试使用scrapyd和scrapy.
当我使用它时,下面的代码工作正常.
import scrapy
from scrapy.selector import Selector
from scrapy.spiders import CrawlSpider
from shikari.items import shikariItem
from scrapy.http import Request
class Radiate(scrapy.Spider) :
name = "run"
allowed_domains = ["google.com"]
start_urls = ['http://google.com']
def parse(self, response) :
item = shikariItem ()
sel = Selector (response)
item['url'] = response.url
return item
Run Code Online (Sandbox Code Playgroud)
但是当我将它与硒一起使用时,却没有
import scrapy
from pyvirtualdisplay import Display
from selenium import webdriver
from shikari.items import shikariItem
class Radiate(scrapy.Spider) :
name = "run"
allowed_domains = ["google.com"]
start_urls = ['http://google.com']
def __init__(self): …Run Code Online (Sandbox Code Playgroud) 我想使用特殊符号,但我得到的却是打印的问号符号 \xef\xbf\xbd
\n\n我试过
\n\n{% autoescape 'html' %}\n {{ '\xc2\xa9'|escape('html') }} {# won't be double-escaped #}\n {{ '\xc2\xa9'|escape(strategy) }} {# will be double-escaped #}\n{% endautoescape %}\nRun Code Online (Sandbox Code Playgroud)\n\n但它不起作用。
\n