zoukankan      html  css  js  c++  java
  • Python_爬虫_爬取网络图片信息01

    源代码:

    import requests

    path = "D:abc.jpg"     #用或/(老师用的)存疑

    r.encoding = r.apparent_encoding

    kv = {'user-agent':'Mozilla/5.0'}

    url = "见列表"

    r = requests.get(url,headers = kv)

    r.status_code

    url地址及状态码

    编号 url地址 状态码
    1 https://img9.doubanio.com/view/photo/raw/public/p2550336184.jpg 403
    2 http://www.ngchina.com.cn/photography/photo_of_the_day/6324.html### 200
    3 https://movie.douban.com/celebrity/1330012/photos/ 200
    4 https://movie.douban.com/celebrity/1330012/photo/2550336184/ 200

    我感觉这个状态码可能是HTTP的状态码,所以百度了一下找到了这篇详细介绍HTTP状态码的文章——https://blog.csdn.net/yumon321/article/details/78597481

    403是服务器拒绝请求,服务器为什么拒绝请求呢?网上没查到啥玩意,我自己尝试了把headers设置成Mozilla/5.0,也没有用。所以我怀疑是网页的问题。

  • 相关阅读:
    Hadoop之hive 其他
    mac 安装mysql
    Mac OS X【快捷键组合】汇总
    一月一城市,一年一大洲
    自信的男生最有魅力
    Python之路
    Hadoop之伪分布环境搭建
    smb
    Maven 安装以及一些开发技巧
    Hadoop之 hdfs 系统
  • 原文地址:https://www.cnblogs.com/Jane-share/p/13207920.html
Copyright © 2011-2022 走看看