设为首页 收藏本站
查看: 906|回复: 0

[经验分享] mongodb存储二进制数据的二种方式——binary bson或gridfs

[复制链接]

尚未签到

发表于 2017-12-15 09:43:33 | 显示全部楼层 |阅读模式
  python 版本为2.7
  mongodb版本2.6.5
  使用mongodb存储文件,可以使用两种方式,一种是像存储普通数据那样,将文件转化为二进制数据存入mongodb,另一种使用gridfs,咱们先来说说第一种
  先读取文件内容,然后塞进bson.binary.Binary对象里,最后像平常那样写入数据库,是不是很简单呢,获取文件一样的简单,像平时那样查找数据,然后将二进制内容写入文件即可
  

#coding=utf-8  
'''
  
Created on 2015-10-8
  

  
@author: kwsy2015
  
'''
  
import pymongo
  
import bson.binary
  
from pymongo import MongoClient
  
from cStringIO import StringIO
  
def insertFile():
  client = MongoClient('localhost', 27017)
  #获得一个database
  db = client.MongoFile
  #获得一个collection
  coll = db.image
  filename = 'F:/测试数据/hehe.jpg'.decode('utf-8')
  with open (filename,'rb') as myimage:
  content = StringIO(myimage.read())
  coll.save(dict(
  content= bson.binary.Binary(content.getvalue()),
  filename = 'hehe.jpg'
  ))
  
def getFile():
  client = MongoClient('localhost', 27017)
  #获得一个database
  db = client.MongoFile
  #获得一个collection
  coll = db.image
  data = coll.find_one({'filename':'hehe.jpg'})
  out = open('F:/测试数据/test4.jpg'.decode('utf-8'),'wb')
  out.write(data['content'])
  out.close()
  
getFile()
  

  因为我的文件路径都带有中文,因此需要用utf-8解码,否则会报错的
  使用上述方法存储小文件是很方便的,那么如果是大文件呢,可以使用gridfs
  gridfs会把文件分成若干块来存储,每一块的大小默认为256K,所以,如果是小文件,就不要用gridfs来存储了,不然会浪费空间的,gridfs是MongoDB之上的分布式文件系统,可以使用mongodb的分片和复制机制,因为Mongodb分配数据空间时以2GB为单位,所以gridfs不产生磁盘碎片。
  

#coding=utf-8  
'''
  
Created on 2015-9-29
  

  
@author: Administrator
  
'''
  
from pymongo import MongoClient
  
from bson.objectid import ObjectId
  
from gridfs import *
  
def insertFile():
  client = MongoClient('localhost', 27017)
  db = client.Pic
  fs = GridFS(db, 'images')
  with open ('F:/测试数据/hehe.jpg'.decode('utf-8'),'rb') as myimage:
  data=myimage.read()        
  id = fs.put(data,filename='first')

  print>  
def getFile():
  client = MongoClient('localhost', 27017)
  db = client.Pic
  fs = GridFS(db, 'images')
  file = fs.get_version('first', 0)
  data = file.read()
  out = open('F:/测试数据/test3.jpg'.decode('utf-8'),'wb')
  out.write(data)
  out.close()
  
def delFile():
  client = MongoClient('localhost', 27017)
  db = client.Pic
  fs = GridFS(db, 'images')
  fs.delete(ObjectId('560a531b0d4eae34a4edbfdd'))
  
def listName():
  client = MongoClient('localhost', 27017)
  db = client.Pic
  fs = GridFS(db, 'images')
  print fs.list()   
  
listName()
  

  写入文件时,我们可以设置它的filename,如果多个文件使用同一个filename呢,我们在获取文件时可以使用get_version()函数,第一个参数是filename,第二个参数是版本,从0开始。
  此外,我们还可以使用get(),函数,需传入文件的ObjectId
  使用python操作gridfs总得来说是很方便的,毕竟所提供的函数就那么几个,稍微用心看看源码就没问题了
  转自:http://www.voidcn.com/blog/KWSY2008/article/p-4871553.html

运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-424272-1-1.html 上篇帖子: mongodb 3.4复制搭建 下篇帖子: Mac下安装 MongoDB
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表