Python_爬虫_爬取网络图片信息01
2020-12-25 06:29
标签:爬取 请求 article path htm 网络图 详细 coding get 源代码: import requests path = "D:\abc.jpg" #用\或/(老师用的)存疑 r.encoding = r.apparent_encoding kv = {‘user-agent‘:‘Mozilla/5.0‘} url = "见列表" r = requests.get(url,headers = kv) r.status_code url地址及状态码 我感觉这个状态码可能是HTTP的状态码,所以百度了一下找到了这篇详细介绍HTTP状态码的文章——https://blog.csdn.net/yumon321/article/details/78597481 403是服务器拒绝请求,服务器为什么拒绝请求呢?网上没查到啥玩意,我自己尝试了把headers设置成Mozilla/5.0,也没有用。所以我怀疑是网页的问题。 Python_爬虫_爬取网络图片信息01 标签:爬取 请求 article path htm 网络图 详细 coding get 原文地址:https://www.cnblogs.com/Jane-share/p/13207920.html
编号
url地址
状态码
1
https://img9.doubanio.com/view/photo/raw/public/p2550336184.jpg
403
2
http://www.ngchina.com.cn/photography/photo_of_the_day/6324.html###
200
3
https://movie.douban.com/celebrity/1330012/photos/
200
4
https://movie.douban.com/celebrity/1330012/photo/2550336184/
200
文章标题:Python_爬虫_爬取网络图片信息01
文章链接:http://soscw.com/index.php/essay/38099.html