获取任意网页的编码格式

2021-06-09 19:02

阅读:741

标签:body   get   arc   arch   准确率   使用   网页   meta   set   

如果是非定向爬虫,不是专门爬一个固定位置的信息,而是成千上万的未知网站,那就需要找到编码格式了,使用如下正则,可以正确找到,准确率99%
content=requests.get(url).content
bianma_group=re.search(‘
if bianma_group:
print bianma_group.group(1)

获取任意网页的编码格式

标签:body   get   arc   arch   准确率   使用   网页   meta   set   

原文地址:http://www.cnblogs.com/ydf0509/p/7298863.html


评论


亲,登录后才可以留言!