mongodb存储二进制数据的二种方式——binary bson或gridfs
python 版本为2.7
mongodb版本2.6.5
使用mongodb存储文件,可以使用两种方式,一种是像存储普通数据那样,将文件转化为二进制数据存入mongodb,另一种使用gridfs,咱们先来说说第一种
先读取文件内容,然后塞进bson.binary.Binary对象里,最后像平常那样写入数据库,是不是很简单呢,获取文件一样的简单,像平时那样查找数据,然后将二进制内容写入文件即可
#coding=utf-8
'''
Created on 2015-10-8 @author: kwsy2015
'''
import pymongo
import bson.binary
from pymongo import MongoClient
from cStringIO import StringIO
def insertFile():
client = MongoClient('localhost', 27017)
#获得一个database
db = client.MongoFile
#获得一个collection
coll = db.image
filename = 'F:/测试数据/hehe.jpg'.decode('utf-8')
with open (filename,'rb') as myimage:
content = StringIO(myimage.read())
coll.save(dict(
content= bson.binary.Binary(content.getvalue()),
filename = 'hehe.jpg'
)) def getFile():
client = MongoClient('localhost', 27017)
#获得一个database
db = client.MongoFile
#获得一个collection
coll = db.image
data = coll.find_one({'filename':'hehe.jpg'})
out = open('F:/测试数据/test4.jpg'.decode('utf-8'),'wb')
out.write(data['content'])
out.close()
getFile()
因为我的文件路径都带有中文,因此需要用utf-8解码,否则会报错的
使用上述方法存储小文件是很方便的,那么如果是大文件呢,可以使用gridfs
gridfs会把文件分成若干块来存储,每一块的大小默认为256K,所以,如果是小文件,就不要用gridfs来存储了,不然会浪费空间的,gridfs是MongoDB之上的分布式文件系统,可以使用mongodb的分片和复制机制,因为Mongodb分配数据空间时以2GB为单位,所以gridfs不产生磁盘碎片。
#coding=utf-8
'''
Created on 2015-9-29 @author: Administrator
'''
from pymongo import MongoClient
from bson.objectid import ObjectId
from gridfs import *
def insertFile():
client = MongoClient('localhost', 27017)
db = client.Pic
fs = GridFS(db, 'images')
with open ('F:/测试数据/hehe.jpg'.decode('utf-8'),'rb') as myimage:
data=myimage.read()
id = fs.put(data,filename='first')
print id
def getFile():
client = MongoClient('localhost', 27017)
db = client.Pic
fs = GridFS(db, 'images')
file = fs.get_version('first', 0)
data = file.read()
out = open('F:/测试数据/test3.jpg'.decode('utf-8'),'wb')
out.write(data)
out.close()
def delFile():
client = MongoClient('localhost', 27017)
db = client.Pic
fs = GridFS(db, 'images')
fs.delete(ObjectId('560a531b0d4eae34a4edbfdd'))
def listName():
client = MongoClient('localhost', 27017)
db = client.Pic
fs = GridFS(db, 'images')
print fs.list()
listName()
写入文件时,我们可以设置它的filename,如果多个文件使用同一个filename呢,我们在获取文件时可以使用get_version()函数,第一个参数是filename,第二个参数是版本,从0开始。
此外,我们还可以使用get(),函数,需传入文件的ObjectId
使用python操作gridfs总得来说是很方便的,毕竟所提供的函数就那么几个,稍微用心看看源码就没问题了
转自:http://www.voidcn.com/blog/KWSY2008/article/p-4871553.html
mongodb存储二进制数据的二种方式——binary bson或gridfs的更多相关文章
- mongodb存储二进制数据
mongodb 3.x存储二进制数据并不是以base64的方式,虽然在mongo客户端的查询结果以base64方式显示,请放心使用.下面来分析存储文件的存储内容.base64编码数据会增长1/3成为顾 ...
- Android学习笔记(十二)——使用意图传递数据的几种方式
使用意图传递数据的几种方式 点此获取完整代码 我们除了要从活动返回数据,也经常要传递数据给活动.对此我们能够使用Intent对象将这些数据传递给目标活动. 1.创建一个名为PassingData的项目 ...
- Linux就这个范儿 第15章 七种武器 linux 同步IO: sync、fsync与fdatasync Linux中的内存大页面huge page/large page David Cutler Linux读写内存数据的三种方式
Linux就这个范儿 第15章 七种武器 linux 同步IO: sync.fsync与fdatasync Linux中的内存大页面huge page/large page David Cut ...
- 讨论HTTP POST 提交数据的几种方式
转自:http://www.cnblogs.com/softidea/p/5745369.html HTTP/1.1 协议规定的 HTTP 请求方法有 OPTIONS.GET.HEAD.POST.PU ...
- 使用 MongoDB 存储日志数据
使用 MongoDB 存储日志数据 线上运行的服务会产生大量的运行及访问日志,日志里会包含一些错误.警告.及用户行为等信息.通常服务会以文本的形式记录日志信息,这样可读性强,方便于日常定位问题 ...
- MongoDB 存储日志数据
MongoDB 存储日志数据 https://www.cnblogs.com/nongchaoer/archive/2017/01/11/6274242.html 线上运行的服务会产生大量的运行及访问 ...
- SparkStreaming获取kafka数据的两种方式:Receiver与Direct
简介: Spark-Streaming获取kafka数据的两种方式-Receiver与Direct的方式,可以简单理解成: Receiver方式是通过zookeeper来连接kafka队列, Dire ...
- SparkStreaming与Kafka,SparkStreaming接收Kafka数据的两种方式
SparkStreaming接收Kafka数据的两种方式 SparkStreaming接收数据原理 一.SparkStreaming + Kafka Receiver模式 二.SparkStreami ...
- 【代码笔记】iOS-向服务器传JSON数据的两种方式
一,代码. - (void)viewDidLoad { [super viewDidLoad]; // Do any additional setup after loading the view. ...
随机推荐
- Openlayers3 编辑要素
参考文章 Openlayers之编辑要素 MAPZONE GIS SDK接入Openlayers3之五——图形编辑工具 [学习笔记之Openlayers3]要素保存篇(第四篇) openlayers实 ...
- 【Exception】查看异常出现在具体的文件名/类名/方法名/具体行号
今天在处理异常日志保存过程中,想要获取到异常抛出在具体在那个文件,哪个类下的哪个方法中的具体第几行,所以具体实现如下 try{ Integer adminID = Integer.parseInt(a ...
- sublime text 3和sublime text 2的 package control 插件 代码
SECURITY NOTICE: The Python code used by this method does not use SSL because Sublime Text on Linux ...
- Neural Networks and Deep Learning学习笔记ch1 - 神经网络
近期開始看一些深度学习的资料.想学习一下深度学习的基础知识.找到了一个比較好的tutorial,Neural Networks and Deep Learning,认真看完了之后觉得收获还是非常多的. ...
- Redis及其Sentinel配置项详细说明
Redis及其Sentinel配置项详细说明 http://lixiaohui.iteye.com/blog/2315516
- iOS 插件制作
概述 我们平时也使用了非常多的xcode插件,尽管官方对于插件制作没有提供不论什么支持,可是载入三方的插件,默认还是被同意的.第三方的插件,须要存放在 ~/Library/Application Su ...
- Git bare repo with multiple branches
http://stackoverflow.com/questions/9324762/git-bare-repo-with-multiple-branches Q: I want to make a ...
- HDU 3308 LCIS (线段树·单点更新·区间合并)
题意 给你一个数组 有更新值和查询两种操作 对于每次查询 输出相应区间的最长连续递增子序列的长度 基础的线段树区间合并 线段树维护三个值 相应区间的LCIS长度(lcis) 相应区间以左 ...
- MacBook Pro使用初体验之Mac快捷键汇总(持续更新中)
我于近日购置了一台13寸的MacBook Pro高配,打算開始进行iOS开发的学习.Pro的配置情况例如以下: (1)OS X Yosemite ,版本号10.10.3 (2)Retina显示屏,13 ...
- React Native学习(二)之View
React Native组件解析(二)之View 0.JSX React的核心机制之一就是虚拟DOM:可以在内存中创建的虚拟DOM元素.React利用虚拟DOM来减少对实际DOM的操作从而提升性能. ...