Python_爬虫_爬取网络图片信息01

源代码:

import requests

path = "D:abc.jpg" #用或/（老师用的）存疑

r.encoding = r.apparent_encoding

kv = {'user-agent':'Mozilla/5.0'}

url = "见列表"

r = requests.get(url,headers = kv)

r.status_code

url地址及状态码

编号	url地址	状态码
1	https://img9.doubanio.com/view/photo/raw/public/p2550336184.jpg	403
2	http://www.ngchina.com.cn/photography/photo_of_the_day/6324.html###	200
3	https://movie.douban.com/celebrity/1330012/photos/	200
4	https://movie.douban.com/celebrity/1330012/photo/2550336184/	200

我感觉这个状态码可能是HTTP的状态码，所以百度了一下找到了这篇详细介绍HTTP状态码的文章——https://blog.csdn.net/yumon321/article/details/78597481

403是服务器拒绝请求，服务器为什么拒绝请求呢？网上没查到啥玩意，我自己尝试了把headers设置成Mozilla/5.0，也没有用。所以我怀疑是网页的问题。

查看全文

相关阅读:
第14章位图和位块传输_14.1-14.3 位图基础
 第13章使用打印机_13.2 打印图形和文字
 第13章使用打印机_13.1 打印基础
 第12章剪贴板_12.3 实现一个剪贴板查看器
 第12章剪贴板_12.2 剪贴板的高级用法
 第12章剪贴板_12.1 剪贴板的简单用法
 第11章对话框_11.3 通用对话框
 第11章对话框_11.2 非模态对话框
 第11章对话框_11.1 模态对话框
 第5章作业和进程池(2)