Redis 笔记

本贴最后更新于 2814 天前,其中的信息可能已经事过景迁

数据结构

  • SortedSet zunionstore 方法可以对一个或者多个有序集合(sortedset)进行并集计算,如果目标集合是set,而不是sorted set,也可以进行合并
  • SortedSet zunionstore 方法,当目标存储集合已经存在时,会进行值的覆盖
  • Hash
    • 这种结构,其内容实现其实是一个HashMap,即key对应一个字符串,而value是使用HashMap实现的。如图

hashredis

    • 只需要通过key+field既可以获取到value值。redis是单线程模型,如果map中的数据过大,遍历需要很长时间的话,就会阻塞客户端其他对redis的操作,这点需要注意。
    • 另外,当hash成员数量较少时,其内部实现是使用类似一维数组的方式(ziplist)来紧凑存储,以节约内存空间,而当成员数量较大时,才会使用hashmap的方式存储。
  • key
    • 必须是一个字符串类型,不能包含边界字符,比如包括空格和换行\n等是被认为非法的,也不能包括redis协议中认定的特殊字符,如\r\n
    • 推荐key的写法是object-type:id:field,同时key不能太长,明显占内存
  • List 内部实现是使用一个双向链表,方便正向和反向进行查找
  • Set
    • 内部实现也是一个HashMap,只是HashMap的value值永远为null
    • set是不会有重复元素的,就是根据计算value的hash值进行快速排重
    • set是无序的,不过可以通过sort命令进行二次排序,而且可以参照第三方的进行排序
  • SortedSet
    • 内部使用HashMap和SkipList实现,skiplist用来存储value,其特点是查找快,节约存储空间。HashMap中存储的是value和score的映射关系
    • 自动排序,即放入其中后,根据score值自动排序,当你需要一个有序且不重复的集合的时候考虑使用sortedset

性能

  • SortedSet 性能取决于其中存储的元素个数

性能

持久化

  • 定时快照方式(snapshot)
    • 内部使用一个定时器,定期检查数据发生的改变次数和时间是否满足配置的持久化触发条件,如果满足就由操作系统fork一个子进程来执行持久化操作,即子进程就可以遍历整个内存空间进行存储,而此时父进程仍然提供正常的服务
    • 该方案的缺点是,存储的定时快照只是一段时间内的内存映像,重启后,上次快照存储后到重启这段时间内的内存数据会丢失
    • 每次做快照方式存储数据时,都会将整个内存数据重新保存一次,而不是增量存储
  • 基于语句追加文件的方式(aof)
    • 即append of file 方式,将每次使redis数据发生变化的语句都会被追加到一个log文件中,这个log文件即是持久化的数据
    • 缺点是数据量大的时侯,log文件体积过大,从而重启时,加载数据进入内存会非常缓慢,几十G的数据需要几个小时,因为每个命令都要执行一遍,另外,每个命令都要写log,redis读写性能也会下降
  • 虚拟内存(vm) — 放弃
  • disk store  — 实践中
  • 在持久化方案中,磁盘IO带来的问题
    • 当使用的物理内存将要达到上限时,会发生redis崩溃的现象,这种情况原因是在读写持久化文件时会将该文件加载到内存中,从而内存中就会有2份重复的数据,导致操作系统让你的进程进行swap操作,此时开始不稳定甚至崩溃(现在已经有maxmemory-policy选项了)
    • 经验是 redis使用的物理内存达到内存总容量的3/5时就比较危险了

事务

  • 提供事务支持,可以保证一串命令操作的原子性,中间不会被其他命令打断,其实质是开启事务后(multi),所有操作命令会放在一个队列中,然后一起执行,保证执行过程中不会被其他命令打断
  • 当这一串命令中某个命令发生错误时,事务终止,同时已经执行的命令不能进行回滚
  • watch命令可以监视某个key,在调用watch命令后到exec执行,这段时间内如果这个key的值发生了变化,那么整个事务就会失败(乐观锁)
  • 在事务中,2个操作存在依赖关系,就要注意了,不能让一个写操作依赖一个读操作,因为事务中的操作并没有立即执行,在事务将操作命令加入队列过程中,有可能其他的客户端会操作这个key,也就是这个key并没有做任何的同步,所以我们需要使用watch来监视此key
  • 关于事务的应用请参考这篇文章

适用场景

  • 朋友最近活动
  • leader board 排行榜功能,在线游戏时,可以随时获取新的排行数据,通过ZRANG
  • 猜测可能认识的人,结合使用ZRANK和ZRANGE方法,可以查出与指定对象相似的对象出来
  • 关注数与被关注数
  • 计数:最近用户在页面间停顿时间不超过60秒的页面浏览量
  • 作为索引数据存储的结构,score存储为数值,value为对象id,使用ZRANGEBYSCORE检索一个确切的范围

用作缓存

  • 2种方式可以把redis当做缓存来使用
    • 给每个键设置一个固定的过期时间,但是这样内存也需要额外的空间来存储这些过期时间
    • 通过设置内存使用上限和指定内存策略算法
maxmemory 2mb
maxmemory-policy allkeys-lru
  • 相比使用额外内存空间存储多个键的过期时间,使用缓存设置是一种更加有效利用内存的方式。而且相比每个键固定的 过期时间,使用LRU也是一种更加推荐的方式,因为这样能使应用的热数据(更频繁使用的键) 在内存中停留时间更久。
  • 基本上这么配置下的Redis可以当成memcached使用。当我们把Redis当成缓存来使用的时候,如果应用程序同时也需要把Redis当成存储系统来使用,那么强烈建议 使用两个Redis实例。一个是缓存,使用上述方法进行配置,另一个是存储,根据应用的持久化需求进行配置,并且 只存储那些不需要被缓存的数据。 

Master Slave复制

  • 一个master可以有多个slave,而一个slave也可以连接其他的slave,形成图状结构
  • master在与slave进行通信时,是可以继续处理客户端请求的;而slave在与master进行通信时,就会阻塞客户端的请求
  • 主从复制的场景,用于提高系统的伸缩性,即让slave负责读取操作,master负责写操作;或者也可以仅仅让slave作为冗余存储
  • 主从复制主要是分为2个步骤,第一个是同步数据,从master中把snapshot发送给slave,第二个是命令传播,master中的写操作都会传递给slave
  • 没有增量复制功能,只是用snapshot重建slave内存结构,新浪微薄版本的redis已经实现了增量复制功能
  • 每次slave重连master,master都会把shapshot重新发送给slave,重建内存数据结构(使用2.8版本+以上的psync命令,可以实现增量复制)
  • 可以通过主动复制来避免redis自身主从复制的缺点,既从客户端对存储的数据进行双写或者多写,数据的多份复制机制,可以避免单点失效故障
  • 这种主动复制功能的缺陷就是如何保证多个节点数据的一致性?需要引入一致性算法,但是这样也会降低写性能
  • 如果有多个slave发来同步命令,master后台只会启动一个进程来写snapshot,然后发送给所有的slave
  • 关于主从复制实现的详细步骤,可以参考黄健宏的视频ppt
  • master最好不要写snapshot,数据量大时会阻塞主线程运行

可扩展集群

  • 100g的业务数据量,假设服务器内存是50g,那么根据磁盘io问题考虑,需要3-4台服务器存储
  • 当数据量达到这个级别时就需要考虑动态在线扩容的问题了
  • 拆分过程(presharding方案)
    • 在新机器上启动好对应端口的Redis实例
    • 配置新端口为待迁移端口的从库
    • 待复制完成,与主库完成同步后,切换所有客户端配置到新的从库的端口
    • 配置从库为新的主库
    • 移除老的端口实例
    • 重复上述过程迁移好所有的端口到指定服务器上

使用总结

  • 根据业务需要选择合适的数据结构,为不同的使用场景设定不同的紧凑型存储参数
  • 当业务场景不需要进行数据持久化时,关闭所有的持久化参数,以获得最大的性能和内存使用量
  • 需要使用持久化时,根据业务特性,是否容忍数据丢失,从而选择aof或者snapshot方式中的一种,不要使用vm和diskstore
  • 不要使得redis实际内存使用量达到最大物理内存的3/5
  • 基于实际项目的一些建议
  • 持久化方案首选AOF方式

改进思路

  • 可以做到按照AOF文件大小自动分割滚动
  • 实际项目可以采取与Mysql结合的方式,即mysql作为主库,Redis作为高速查询从库的异构读写分离的方案

redismysql

客户端、二次开发相关

  • Redis

    Redis 是一个开源的使用 ANSI C 语言编写、支持网络、可基于内存亦可持久化的日志型、Key-Value 数据库,并提供多种语言的 API。从 2010 年 3 月 15 日起,Redis 的开发工作由 VMware 主持。从 2013 年 5 月开始,Redis 的开发由 Pivotal 赞助。

    284 引用 • 247 回帖 • 172 关注
  • slave
    2 引用 • 2 回帖
  • 持久化
    3 引用 • 8 回帖

相关帖子

2 回帖

欢迎来到这里!

我们正在构建一个小众社区,大家在这里相互信任,以平等 • 自由 • 奔放的价值观进行分享交流。最终,希望大家能够找到与自己志同道合的伙伴,共同成长。

注册 关于
请输入回帖内容 ...

推荐标签 标签

  • OpenResty

    OpenResty 是一个基于 NGINX 与 Lua 的高性能 Web 平台,其内部集成了大量精良的 Lua 库、第三方模块以及大多数的依赖项。用于方便地搭建能够处理超高并发、扩展性极高的动态 Web 应用、Web 服务和动态网关。

    17 引用 • 41 关注
  • Node.js

    Node.js 是一个基于 Chrome JavaScript 运行时建立的平台, 用于方便地搭建响应速度快、易于扩展的网络应用。Node.js 使用事件驱动, 非阻塞 I/O 模型而得以轻量和高效。

    138 引用 • 268 回帖 • 192 关注
  • 尊园地产

    昆明尊园房地产经纪有限公司,即:Kunming Zunyuan Property Agency Company Limited(简称“尊园地产”)于 2007 年 6 月开始筹备,2007 年 8 月 18 日正式成立,注册资本 200 万元,公司性质为股份经纪有限公司,主营业务为:代租、代售、代办产权过户、办理银行按揭、担保、抵押、评估等。

    1 引用 • 22 回帖 • 688 关注
  • RESTful

    一种软件架构设计风格而不是标准,提供了一组设计原则和约束条件,主要用于客户端和服务器交互类的软件。基于这个风格设计的软件可以更简洁,更有层次,更易于实现缓存等机制。

    30 引用 • 114 回帖
  • SVN

    SVN 是 Subversion 的简称,是一个开放源代码的版本控制系统,相较于 RCS、CVS,它采用了分支管理系统,它的设计目标就是取代 CVS。

    29 引用 • 98 回帖 • 693 关注
  • H2

    H2 是一个开源的嵌入式数据库引擎,采用 Java 语言编写,不受平台的限制,同时 H2 提供了一个十分方便的 web 控制台用于操作和管理数据库内容。H2 还提供兼容模式,可以兼容一些主流的数据库,因此采用 H2 作为开发期的数据库非常方便。

    11 引用 • 54 回帖 • 640 关注
  • ngrok

    ngrok 是一个反向代理,通过在公共的端点和本地运行的 Web 服务器之间建立一个安全的通道。

    7 引用 • 63 回帖 • 598 关注
  • 京东

    京东是中国最大的自营式电商企业,2015 年第一季度在中国自营式 B2C 电商市场的占有率为 56.3%。2014 年 5 月,京东在美国纳斯达克证券交易所正式挂牌上市(股票代码:JD),是中国第一个成功赴美上市的大型综合型电商平台,与腾讯、百度等中国互联网巨头共同跻身全球前十大互联网公司排行榜。

    14 引用 • 102 回帖 • 406 关注
  • Swift

    Swift 是苹果于 2014 年 WWDC(苹果开发者大会)发布的开发语言,可与 Objective-C 共同运行于 Mac OS 和 iOS 平台,用于搭建基于苹果平台的应用程序。

    34 引用 • 37 回帖 • 497 关注
  • 职场

    找到自己的位置,萌新烦恼少。

    126 引用 • 1699 回帖 • 2 关注
  • VirtualBox

    VirtualBox 是一款开源虚拟机软件,最早由德国 Innotek 公司开发,由 Sun Microsystems 公司出品的软件,使用 Qt 编写,在 Sun 被 Oracle 收购后正式更名成 Oracle VM VirtualBox。

    10 引用 • 2 回帖 • 7 关注
  • Latke

    Latke 是一款以 JSON 为主的 Java Web 框架。

    70 引用 • 532 回帖 • 713 关注
  • 阿里云

    阿里云是阿里巴巴集团旗下公司,是全球领先的云计算及人工智能科技公司。提供云服务器、云数据库、云安全等云计算服务,以及大数据、人工智能服务、精准定制基于场景的行业解决方案。

    89 引用 • 345 回帖
  • Sillot

    Sillot (汐洛)孵化自思源笔记,致力于服务智慧新彖乄,具有彖乄驱动、极致优雅、开发者友好的特点
    Github 地址:https://github.com/Hi-Windom/Sillot

    17 引用 • 6 回帖 • 27 关注
  • MySQL

    MySQL 是一个关系型数据库管理系统,由瑞典 MySQL AB 公司开发,目前属于 Oracle 公司。MySQL 是最流行的关系型数据库管理系统之一。

    675 引用 • 535 回帖
  • CSS

    CSS(Cascading Style Sheet)“层叠样式表”是用于控制网页样式并允许将样式信息与网页内容分离的一种标记性语言。

    180 引用 • 447 回帖
  • 服务器

    服务器,也称伺服器,是提供计算服务的设备。由于服务器需要响应服务请求,并进行处理,因此一般来说服务器应具备承担服务并且保障服务的能力。

    124 引用 • 580 回帖
  • JRebel

    JRebel 是一款 Java 虚拟机插件,它使得 Java 程序员能在不进行重部署的情况下,即时看到代码的改变对一个应用程序带来的影响。

    26 引用 • 78 回帖 • 623 关注
  • Openfire

    Openfire 是开源的、基于可拓展通讯和表示协议 (XMPP)、采用 Java 编程语言开发的实时协作服务器。Openfire 的效率很高,单台服务器可支持上万并发用户。

    6 引用 • 7 回帖 • 87 关注
  • WebComponents

    Web Components 是 W3C 定义的标准,它给了前端开发者扩展浏览器标签的能力,可以方便地定制可复用组件,更好的进行模块化开发,解放了前端开发者的生产力。

    1 引用 • 24 关注
  • Flutter

    Flutter 是谷歌的移动 UI 框架,可以快速在 iOS 和 Android 上构建高质量的原生用户界面。 Flutter 可以与现有的代码一起工作,它正在被越来越多的开发者和组织使用,并且 Flutter 是完全免费、开源的。

    39 引用 • 92 回帖 • 8 关注
  • WordPress

    WordPress 是一个使用 PHP 语言开发的博客平台,用户可以在支持 PHP 和 MySQL 数据库的服务器上架设自己的博客。也可以把 WordPress 当作一个内容管理系统(CMS)来使用。WordPress 是一个免费的开源项目,在 GNU 通用公共许可证(GPLv2)下授权发布。

    45 引用 • 113 回帖 • 310 关注
  • InfluxDB

    InfluxDB 是一个开源的没有外部依赖的时间序列数据库。适用于记录度量,事件及实时分析。

    2 引用 • 55 关注
  • 程序员

    程序员是从事程序开发、程序维护的专业人员。

    534 引用 • 3528 回帖
  • Maven

    Maven 是基于项目对象模型(POM)、通过一小段描述信息来管理项目的构建、报告和文档的软件项目管理工具。

    186 引用 • 318 回帖 • 342 关注
  • 机器学习

    机器学习(Machine Learning)是一门多领域交叉学科,涉及概率论、统计学、逼近论、凸分析、算法复杂度理论等多门学科。专门研究计算机怎样模拟或实现人类的学习行为,以获取新的知识或技能,重新组织已有的知识结构使之不断改善自身的性能。

    76 引用 • 37 回帖 • 1 关注
  • V2EX

    V2EX 是创意工作者们的社区。这里目前汇聚了超过 400,000 名主要来自互联网行业、游戏行业和媒体行业的创意工作者。V2EX 希望能够成为创意工作者们的生活和事业的一部分。

    17 引用 • 236 回帖 • 418 关注