ssdb底层实现——ssdb底层是leveldb，leveldb根本上是skiplist（例如为存储多个list items，必然有多个item key，而非暴力string cat），用它来做redis的list和set等，势必在数据结构和算法层面上有诸多不适

 我已经在用ssdb的hash结构，存储了很多数据了，但是我现在的用法正确吗？ 我使用hash结构合理吗？

1. ssdb数据库说是类似redis，而且他们都有hash结构，但是他们的命名有点不同，ssdb 是（name，key，value），其实相对应的redis是（key，field，value），当然了对于使用函数上还是很像的；

   那么问题来了，ssdb的hash 和redis的hash结构，使用上一样吗？

   ssdb中（name，key）都是不能超过 SSDB_KEY_LEN_MAX= 255， redis就没这个限制。

2. ssdb中hash结构是（name，key，value），但leveldb是跳表结构(SkipList)存储的只有（key，value）；

  （leveldb的 key 实际上是好长的拼装，对应到ssdb 是 name+key，占用了很多空间）；

   std::string dbkey = encode_hash_key(name, key);

   leveldb::Status s = db->Get(leveldb::ReadOptions(), dbkey, val);

   std::string encode_hash_key(const Bytes &name, const Bytes &key){

    std::string buf;

    buf.append(1, DataType::HASH);

    buf.append(1, (uint8_t)name.size());

    buf.append(name.data(), name.size());

    buf.append(1, '=');

    buf.append(key.data(), key.size());

    return buf;

  }

3. ssdb中multi_hget 最好不要用，效率不高应该用 hscan，下面这段是multi_hget，看得出是在循环调用（ serv->ssdb->hget）

  int proc_multi_hget(NetworkServer *net, Link *link, const Request &req, Response *resp){

    CHECK_NUM_PARAMS(3);

    SSDBServer *serv = (SSDBServer *)net->data;

    resp->push_back("ok");

    Request::const_iterator it=req.begin() + 1;

    const Bytes name = *it;

    it ++;

    for(; it!=req.end(); it+=1){

       const Bytes &key = *it;

       std::string val;

       int ret = serv->ssdb->hget(name, key, &val);

       if(ret == 1){

         resp->push_back(key.String());

         resp->push_back(val);

       }

      }

      return 0;

    }

   应该使用hscan ，它的实现是这样的：

   HIterator* SSDBImpl::hscan(const Bytes &name, const Bytes &start, const Bytes &end, uint64_t limit){

    std::string key_start, key_end;

    key_start = encode_hash_key(name, start);

    if(!end.empty()){

        key_end = encode_hash_key(name, end);

    }

    return new HIterator(this->iterator(key_start, key_end, limit), name);

    }

    Iterator* SSDBImpl::iterator(const std::string &start, const std::string &end, uint64_t limit){

    leveldb::Iterator *it;

    leveldb::ReadOptions iterate_options;

    iterate_options.fill_cache = false;

    it = db->NewIterator(iterate_options);

    it->Seek(start);

    if(it->Valid() && it->key() == start){

       it->Next();

    }

    return new Iterator(it, end, limit);

    }

    template<typename Key, class Comparator>

    inline void SkipList<Key,Comparator>::Iterator::Next() {

     assert(Valid());

     node_ = node_->Next(0);

    }

原来看zset 的写入其实是更新了三个数据：

记录zset的记录总数。 std::string encode_zsize_key(const Bytes &name){ std::string buf; buf.append(1, DataType::ZSIZE); buf.append(name.data(), name.size()); return buf; }
按照分数排序的排行榜 key=（name+score+key） `std::string encode_zscore_key(const Bytes & name, const Bytes &key, const Bytes &score){ std::string buf; buf.append(1, DataType::ZSCORE); buf.append(1, (uint8_t)name.size()); buf.append(name.data(), name.size());
```
	int64_t s = score.Int64();

	if(s < 0){

		buf.append(1, '-');

	}else{

		buf.append(1, '=');

	}

	s = encode_score(s);

	buf.append((char *)&s, sizeof(int64_t));

	buf.append(1, '=');

	buf.append(key.data(), key.size());

	return buf;

}`
```
按照（name + key）对应score值的（kv存储） std::string encode_zset_key(const Bytes &name, const Bytes &key){ std::string buf; buf.append(1, DataType::ZSET); buf.append(1, (uint8_t)name.size()); buf.append(name.data(), name.size()); buf.append(1, (uint8_t)key.size()); buf.append(key.data(), key.size()); return buf; }

下面以zset写入命令看，是如何更新这个三块数据库的。 // returns the number of newly added items static int zset_one(SSDBImpl *ssdb, const Bytes &name, const Bytes &key, const Bytes &new_score, char log_type){ int found = ssdb->zget(name, key, &old_score); if(found == 0 || old_score != new_score){ if(found){ // delete zscore key k1 = encode_zscore_key(name, key, old_score); ssdb->binlogs->Delete(k1); } // add zscore key k2 = encode_zscore_key(name, key, new_score); ssdb->binlogs->Put(k2, ""); // update zset k0 = encode_zset_key(name, key); ssdb->binlogs->Put(k0, new_score); ssdb->binlogs->add_log(log_type, BinlogCommand::ZSET, k0); return found? 0 : 1; } return 0; } int SSDBImpl::zset(const Bytes &name, const Bytes &key, const Bytes &score, char log_type){ Transaction trans(binlogs); int ret = zset_one(this, name, key, score, log_type); if(ret >= 0){ if(ret > 0){ if(incr_zsize(this, name, ret) == -1){ return -1; } } leveldb::Status s = binlogs->commit(); if(!s.ok()){ log_error("zset error: %s", s.ToString().c_str()); return -1; } } return ret; }

发现这种查询用户排行多少这种时，效率就非常差了； int64_t SSDBImpl::zrrank(const Bytes &name, const Bytes &key){ ZIterator *it = ziterator(this, name, "", "", "", INT_MAX, Iterator::BACKWARD); uint64_t ret = 0; while(true){ if(it->next() == false){ ret = -1; break; } if(key == it->key){ break; } ret ++; } delete it; return ret; }

总结：按照score分数范围遍历是很高效的，查询用户score分数是很快的。但是查询用户的rank排行，效率就很差，要从小到大遍历。

转自：https://github.com/sunwsh/sunwsh.github.io/wiki/ssdb%E6%BA%90%E7%A0%81%E5%AD%A6%E4%B9%A0--%E7%AC%AC%E4%B8%80%E5%A4%A9%EF%BC%88hash%E7%BB%93%E6%9E%84%EF%BC%89

ssdb底层实现——ssdb底层是leveldb，leveldb根本上是skiplist（例如为存储多个list items，必然有多个item key，而非暴力string cat），用它来做redis的list和set等，势必在数据结构和算法层面上有诸多不适的更多相关文章

数据结构与算法Python版熟悉哈希表，了解Python字典底层实现
Hash Table 散列表(hash table)也被称为哈希表,它是一种根据键(key)来存储值(value)的特殊线性结构. 常用于迅速的无序单点查找,其查找速度可达到常数级别的O(1). 散列 ...
JAVA中调用LevelDB用于Linux和Window环境下快速存储KV结构
一.简介 JAVA中调用LevelDB用于Linux和Window环境下快速存储KV结构二.依赖 <!-- https://mvnrepository.com/artifact/org.fus ...
Redis源码阅读（五）集群-故障迁移（上）
Redis源码阅读(五)集群-故障迁移(上) 故障迁移是集群非常重要的功能:直白的说就是在集群中部分节点失效时,能将失效节点负责的键值对迁移到其他节点上,从而保证整个集群系统在部分节点失效后没有丢失数 ...
Redis 命令，键(key)，字符串(String)，哈希(Hash)，列表(List)，集合(Set)（二）
Redis 命令 Redis 命令用于在 redis 服务上执行操作. 要在 redis 服务上执行命令需要一个 redis 客户端.Redis 客户端在我们之前下载的的 redis 的安装包中. ...
大数据DDos检测——DDos攻击本质上是时间序列数据，t+1时刻的数据特点和t时刻强相关，因此用HMM或者CRF来做检测是必然！和一个句子的分词算法CRF没有区别！
DDos攻击本质上是时间序列数据,t+1时刻的数据特点和t时刻强相关,因此用HMM或者CRF来做检测是必然!——和一个句子的分词算法CRF没有区别!注:传统DDos检测直接基于IP数据发送流量来识别, ...
零元学Expression Blend 4 - Chapter 40 Flash做的到的Blend也可以!轻松制作拥有动画的MenuBar!(上)
原文:零元学Expression Blend 4 - Chapter 40 Flash做的到的Blend也可以!轻松制作拥有动画的MenuBar!(上) 一直以来都有人拿Flash的动画问我Blend ...
深入理解Mysql索引底层数据结构与算法
索引是帮助MySQL高效获取数据的排好序的数据结构索引数据结构对比二叉树左边子节点的数据小于父节点数据,右边子节点的数据大于父节点数据. 如果col2是索引,查找索引为89的行元素,那么只需要查 ...
hashMap 底层原理+LinkedHashMap 底层原理+常见面试题
1.源码 java1.7 hashMap 底层实现是数组+链表 java1.8 对上面进行优化数组+链表+红黑树 2.hashmap 是怎么保存数据的. 在hashmap 中有这样一个结构 ...
django做redis缓存
django中应用redis:pip3 install django-redis - 配置 CACHES = { "default": { "BACKEND": ...

随机推荐

[Android]异常9-自定义PopupWindow出现闪屏
背景: 自定义PopupWindow使用时,Android4.0或者一些手机正常使用,Android6.0或者部分手机使用自定义PopupWindow触发事件时,出现闪屏异常原因: 可能一>A ...
JS——行内式注册事件
html中行内调用function的时候,是通过window调用的function,所以打印this等于打印window,所以在使用行内注册事件时务必传入参数this <!DOCTYPE htm ...
block要用copy修饰,还是用strong
栈区与堆区 block本身是像对象一样可以retain,和release.但是,block在创建的时候,它的内存是分配在栈(stack)上,而不是在堆(heap)上.他本身的作于域是属于创建时候的作用 ...
CAD调用导角命令，并返回导角的圆弧对象
主要用到函数说明: _DMxDrawX::SendStringToExecuteFun 把命令当着函数执行,可以传参数,详细说明如下: 参数说明 IDispatch* pParam 命令参数,IMx ...
PAT_A1018#Public Bike Management
Source: PAT A1018 Public Bike Management (30 分) Description: There is a public bike service in Hangz ...
Chrome Headless模式
在 Chrome 59 版本开始已经开始支持了 Headless 模式,也就是无界面模式,这样爬取的时候就不会弹出浏览器了,如果要使用此模式请把 Chrome 升级到 59 版本及以上,启用 Head ...
Python之类方法，lambda，闭包简谈
类方法,lambda,闭包类方法 lambda 闭包类方法 classmethod staticmethod instancemethod 类方法类方法,通过装饰器@classmethod来标明 ...
修改bash命令提示符
说明:PS1是主要的提示符设置,在ubuntu一般为: ${debian_chroot:+($debian_chroot)}\u@\h:\w\$ 具体的提示符,按分类含义如下: 主要信息: \u 当前 ...
06007_redis数据存储类型——hash
1.概述 (1)Redis中的Hash类型可以看成具有String Key和String Value的map容器.所以该类型非常适合于存储值对象的信息,如Username.Password和Age等: ...
【codeforces 510B】Fox And Two Dots
[题目链接]:http://codeforces.com/contest/510/problem/B [题意] 让你在一个二维的方格里面找环; 两个点有相邻的边它们才是相连的; 有环YES,没环NO ...

ssdb底层实现——ssdb底层是leveldb，leveldb根本上是skiplist（例如为存储多个list items，必然有多个item key，而非暴力string cat），用它来做redis的list和set等，势必在数据结构和算法层面上有诸多不适

ssdb底层实现——ssdb底层是leveldb，leveldb根本上是skiplist（例如为存储多个list items，必然有多个item key，而非暴力string cat），用它来做redis的list和set等，势必在数据结构和算法层面上有诸多不适的更多相关文章

随机推荐

热门专题