From 5ee086e7b6b732f33553a0c8b7e34c488c660a63 Mon Sep 17 00:00:00 2001 From: Akshay Sharma <42249933+akshaysharmajs@users.noreply.github.com> Date: Sat, 31 Jul 2021 20:30:43 +0530 Subject: [PATCH] Update scrapy/responsetypes.py MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Co-authored-by: Adrián Chaves --- scrapy/responsetypes.py | 15 ++------------- 1 file changed, 2 insertions(+), 13 deletions(-) diff --git a/scrapy/responsetypes.py b/scrapy/responsetypes.py index c6b00c2a1..7d67675d6 100644 --- a/scrapy/responsetypes.py +++ b/scrapy/responsetypes.py @@ -140,19 +140,8 @@ class ResponseTypes: body = body[:RESOURCE_HEADER_BUFFER_LENGTH].replace(b"\x00", b"") cls = Response - http_origin = True - content_types = None - - if url and urlparse(url).scheme not in ("http", "https"): - http_origin = False - - if headers: - content_types = self._guess_content_type(content_type=headers.getlist(b'Content-Type'), - content_disposition=headers.get(b'Content-Disposition'), - url=url, filename=filename) - else: - content_types = self._guess_content_type(url=url, filename=filename) - + http_origin = not url or urlparse(url).scheme in ("http", "https") + content_types = self._guess_content_type(headers=headers, url=url, filename=filename) mime_type = extract_mime(body, content_types=content_types, http_origin=http_origin) cls = self.from_mimetype(mime_type.decode())