首页
学习
活动
专区
工具
TVP
发布
精选内容/技术社群/优惠产品,尽在小程序
立即前往

python爬虫神器,自动判断网页编码格式,无需手动查询!

1.chardet下载

2.解压安装

3.打开windows命令行窗口

如果你感觉学不会?莫慌,小编推荐大家加入群,

前面548中间377后面875,群里有志同道合的小伙伴,

互帮互助,还可以拿到许多视频教程!

示例代码:

importchardet

importurllib

#可根据需要,选择不同的数据

TestData=urllib.urlopen('http冒号//大不了.163.炕/').read()

printchardet.detect(TestData)

运行结果:

{'confidence':0.99,'encoding':'GB2312'}

GB2312 则是编码

  • 发表于:
  • 原文链接https://kuaibao.qq.com/s/20180926A0X14T00?refer=cp_1026
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

扫码

添加站长 进交流群

领取专属 10元无门槛券

私享最新 技术干货

扫码加入开发者社群
领券