diff --git a/tests/sample_data/link_extractor/linkextractor_latin1.html b/tests/sample_data/link_extractor/linkextractor_latin1.html
index 68609d8d3..fc31d7e5d 100644
--- a/tests/sample_data/link_extractor/linkextractor_latin1.html
+++ b/tests/sample_data/link_extractor/linkextractor_latin1.html
@@ -1,15 +1,18 @@
-
-
-
-Sample page with links for testing RegexLinkExtractor
-
+
+
+
+ Sample page with links for testing RegexLinkExtractor
+
-
+
diff --git a/tests/test_linkextractors_deprecated.py b/tests/test_linkextractors_deprecated.py
index 7759575f3..36dfe174f 100644
--- a/tests/test_linkextractors_deprecated.py
+++ b/tests/test_linkextractors_deprecated.py
@@ -84,12 +84,19 @@ class BaseSgmlLinkExtractorTestCase(unittest.TestCase):
# document encoding does not affect URL path component, only query part
# >>> u'sample_ñ.html'.encode('utf8')
- # 'sample_\xc3\xb1.html'
+ # b'sample_\xc3\xb1.html'
# >>> u"sample_á.html".encode('utf8')
- # 'sample_\xc3\xa1.html'
+ # b'sample_\xc3\xa1.html'
+ # >>> u"sample_ö.html".encode('utf8')
+ # b'sample_\xc3\xb6.html'
+ # >>> u"£32".encode('latin1')
+ # b'\xa332'
+ # >>> u"µ".encode('latin1')
+ # b'\xb5'
self.assertEqual(lx.extract_links(response_latin1), [
Link(url='http://example.com/sample_%C3%B1.html', text=''),
Link(url='http://example.com/sample_%C3%A1.html', text='sample \xe1 text'.decode('latin1')),
+ Link(url='http://example.com/sample_%C3%B6.html?price=%A332&%B5=unit', text=''),
])
def test_matches(self):