码迷,mamicode.com
首页 > 编程语言 > 详细

Python_爬虫_爬取网络图片信息01

时间:2020-06-29 15:37:10      阅读:77      评论:0      收藏:0      [点我收藏+]

标签:爬取   请求   article   path   htm   网络图   详细   coding   get   

源代码:

import requests

path = "D:\abc.jpg"     #用\或/(老师用的)存疑

r.encoding = r.apparent_encoding

kv = {‘user-agent‘:‘Mozilla/5.0‘}

url = "见列表"

r = requests.get(url,headers = kv)

r.status_code

 

url地址及状态码

编号 url地址 状态码
1 https://img9.doubanio.com/view/photo/raw/public/p2550336184.jpg 403
2 http://www.ngchina.com.cn/photography/photo_of_the_day/6324.html### 200
3 https://movie.douban.com/celebrity/1330012/photos/ 200
4 https://movie.douban.com/celebrity/1330012/photo/2550336184/ 200

 

我感觉这个状态码可能是HTTP的状态码,所以百度了一下找到了这篇详细介绍HTTP状态码的文章——https://blog.csdn.net/yumon321/article/details/78597481

403是服务器拒绝请求,服务器为什么拒绝请求呢?网上没查到啥玩意,我自己尝试了把headers设置成Mozilla/5.0,也没有用。所以我怀疑是网页的问题。

Python_爬虫_爬取网络图片信息01

标签:爬取   请求   article   path   htm   网络图   详细   coding   get   

原文地址:https://www.cnblogs.com/Jane-share/p/13207920.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!