python爬不同图片分别保存在不同文件夹中的实现
更新时间:2021年04月02日 10:44:54 作者:流楚丶格念
这篇文章主要介绍了python爬不同图片分别保存在不同文件夹中的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧
例如,爬取赵丽颖,赵本山,赵文卓,赵欢,赵日天的图片分别保存在赵丽颖,赵本山,赵文卓,赵欢,赵日天命名的文件夹中,
测试代码
别的图就不放了
import requests import time import os # 请求头,伪装成浏览器 headers = { 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/53.0.2785.116 Safari/537.36' } # keyword = '云斑白条天牛' # 关键字 keywords = ['赵丽颖','赵本山','赵文卓','赵欢','赵日天'] max_page = 2 i=1 # 记录图片数 for keyword in keywords: os.makedirs(keyword) for page in range(1,max_page): page = page*30 # 网址 url = 'https://image.baidu.com/search/acjson?tn=resultjson_com&ipn=rj&ct=201326592&is=&fp=result&queryWord='\ +keyword+'&cl=2&lm=-1&ie=utf-8&oe=utf-8&adpicid=&st=-1&z=&ic=0&hd=&latest=©right=&word='\ +keyword+'&s=&se=&tab=&width=&height=&face=0&istype=2&qc=&nc=1&fr=&expermode=&force=&cg=wallpaper&pn='\ +str(page)+'&rn=30&gsm=1e&1596899786625=' # 请求响应 response = requests.get(url=url,headers=headers) # 得到相应的json数据 json = response.json() if json.get('data'): for item in json.get('data')[:30]: # 图片地址 img_url = item.get('thumbURL') # 获取图片 image = requests.get(url=img_url) # 下载图片 newstr = './'+keyword+'/'+str(i)+'.jpg' # with open('./%s/%d.jpg'%keywords ,%i,'wb') as f: with open(newstr,'wb') as f: f.write(image.content) # 图片二进制数据 time.sleep(1) # 等待1s print('第%d张%s图片下载完成...'%(i,keyword)) i+=1 print('End!')
你要修改的参数
将你想要爬的数据填入keywords 数组中即可
# 这里放你要查询的数组 keywords = ['','','',']
max_page是爬取百度图片的页数,一页是30张,这里写2的话就能爬30张,3能爬60张,以此类推
max_page = 3
你要的代码
代码如下:
import requests import time import os # 请求头,伪装成浏览器 headers = { 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/53.0.2785.116 Safari/537.36' } # 这里放你要查询的数组 keywords = ['','','','] max_page = 4 i=1 # 记录图片数 for keyword in keywords: os.makedirs(keyword) for page in range(1,max_page): page = page*30 # 网址 url = 'https://image.baidu.com/search/acjson?tn=resultjson_com&ipn=rj&ct=201326592&is=&fp=result&queryWord='\ +keyword+'&cl=2&lm=-1&ie=utf-8&oe=utf-8&adpicid=&st=-1&z=&ic=0&hd=&latest=©right=&word='\ +keyword+'&s=&se=&tab=&width=&height=&face=0&istype=2&qc=&nc=1&fr=&expermode=&force=&cg=wallpaper&pn='\ +str(page)+'&rn=30&gsm=1e&1596899786625=' # 请求响应 response = requests.get(url=url,headers=headers) # 得到相应的json数据 json = response.json() if json.get('data'): for item in json.get('data')[:30]: # 图片地址 img_url = item.get('thumbURL') # 获取图片 image = requests.get(url=img_url) # 下载图片 newstr = './'+keyword+'/'+str(i)+'.jpg' # with open('./%s/%d.jpg'%keywords ,%i,'wb') as f: with open(newstr,'wb') as f: f.write(image.content) # 图片二进制数据 time.sleep(1) # 等待1s print('第%d张%s图片下载完成...'%(i,keyword)) i+=1 print('End!')
到此这篇关于python爬不同图片分别保存在不同文件夹中的实现的文章就介绍到这了,更多相关python爬图片保存不同文件夹内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家!
相关文章
解决pycharm下os.system执行命令返回有中文乱码的问题
今天小编就为大家分享一篇解决pycharm下os.system执行命令返回有中文乱码的问题,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧2019-07-07对python:threading.Thread类的使用方法详解
今天小编就为大家分享一篇对python:threading.Thread类的使用方法详解,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧2019-01-01
最新评论