我有一个字符串:
'BZh91AY&SYA\xaf\x82\r\x00\x00\x01\x01\x80\x02\xc0\x02\x00 \x00!\x9ah3M\x07<]\xc9\x14\xe1BA\x06\xbe\x084'
我想要:
b'BZh91AY&SYA\xaf\x82\r\x00\x00\x01\x01\x80\x02\xc0\x02\x00 \x00!\x9ah3M\x07<]\xc9\x14\xe1BA\x06\xbe\x084'
但我一直在想:
b'BZh91AY&SYA\\xaf\\x82\\r\\x00\\x00\\x01\\x01\\x80\\x02\\xc0\\x02\\x00 \\x00!\\x9ah3M\\x07<]\\xc9\\x14\\xe1BA\\x06\\xbe\\x084'
Context
我从网页上抓取了一个字符串,并将其存储在变量un
中。现在我想用BZip2解压它:
bz2.decompress(un)
但是,因为un
是一个str
对象,所以我得到了这个错误:
TypeError: a bytes-like object is required, not 'str'
因此,我需要将un
转换为类似字节的对象,而不需要将单个反斜杠更改为转义反斜杠。
编辑1:谢谢你的帮助!@wim我现在明白你的意思了,但是我不知道如何从我的webscraping方法中检索一个类似字节的对象:
r = requests.get('http://www.pythonchallenge.com/pc/def/integrity.html')
doc = html.fromstring(r.content)
comment = doc.xpath('//comment()')[0].text.split('\n')[1:3]
pattern = re.compile("[a-z]{2}: '(.+)'")
un = re.search(pattern, comment[0]).group(1)
我使用的包是requests
、lxml.html
、re
和bz2
。
再一次,我的目标是使用bz2
解压un
,但是我很难从我的网络抓取过程中获得一个类似字节的对象。
有什么建议吗?
https://stackoverflow.com/questions/51457418
复制相似问题