0

0

如何使用c++和RocksDB实现一个高性能的嵌入式键值存储? (LSM树)

尼克

尼克

发布时间:2026-01-22 15:39:07

|

493人浏览过

|

来源于php中文网

原创

RocksDB 本身是用 C++ 编写的最优嵌入式 LSM 实现,无需“用 C++ 和 RocksDB 实现”;关键在于正确配置 Options(如 create_if_missing、max_open_files、bytes_per_sync)和 BlockBasedTableOptions(启用 LRUCache),而非重写底层逻辑。

如何使用c++和rocksdb实现一个高性能的嵌入式键值存储? (lsm树)

为什么 RocksDB 本身已经是最优嵌入式 LSM 实现,不必“用 C++ 和 RocksDB 实现”

RocksDB 就是用 C++ 写的、专为高性能嵌入式键值存储设计的 LSM-tree 引擎。所谓“用 C++ 和 RocksDB 实现”,实际就是正确配置和调用 RocksDB 的 C++ API。很多项目踩坑,是因为误以为要自己手写 memtable、SST 文件格式或 compaction 调度——这些恰恰是 RocksDB 已经高度优化、不建议覆盖的部分。

真正需要关注的是:如何根据你的数据访问模式(读多写少?点查为主?批量导入?)选对 OptionsColumnFamilyOptions,以及如何避免常见反模式。

初始化时必须显式设置的三个关键 Options

默认构造的 rocksdb::Options 适合测试,但生产环境几乎总是需要调整。漏掉以下任一配置,都可能导致吞吐骤降或内存失控:

  • options.create_if_missing = true:否则打开不存在的 DB 会失败
  • options.max_open_files = -1:禁用文件句柄限制(RocksDB 自行管理缓存),否则在高并发下频繁 open/close SST 文件,I/O 毛刺明显
  • options.bytes_per_sync = 512 * 1024:控制 WAL 同步粒度;太小(如 0)→ 每次写都 fsync,延迟飙升;太大(如 1MB+)→ 崩溃可能丢失更多数据;512KB 是多数 SSD 的平衡点

另外,options.use_fsync = false(默认)配合 bytes_per_sync 更安全,比盲目设 use_fsync = true 更可控。

立即学习C++免费学习笔记(深入)”;

点查性能差?先检查 BlockBasedTableOptions 和 cache 配置

90% 的“RocksDB 查询慢”问题,根源不在 LSM 结构本身,而在表格式和缓存没配对。默认的 BlockBasedTableOptions 不启用 block cache,相当于每次读都要解压 + 查找 SST 块。

正确做法:

Sora
Sora

Sora是OpenAI发布的一种文生视频AI大模型,可以根据文本指令创建现实和富有想象力的场景。

下载
  • 创建 rocksdb::LRUCache,大小建议 ≥ 1GB(例如 rocksdb::NewLRUCache(1ULL )
  • 将 cache 绑定到 table_options.block_cache,而非 table_options.block_cache_compressed(除非你明确压缩 hot data)
  • 开启 table_options.cache_index_and_filter_blocks = true:把 index/filter 加载进 block cache,避免每次查找都读磁盘
  • 确认 options.optimize_filters_for_hits = true:当 95%+ 查询命中 key 时,跳过 bloom filter 检查,省一次 cache miss

未配 cache 时,单次 Get() 可能触发多次随机 I/O;配好后,热 key 基本落在内存,P99 延迟从 10ms+ 降到 100μs 内。

写放大过高或 compaction 卡住?优先调 level0_file_num_compaction_triggermax_bytes_for_level_base

LSM 的写放大主要来自 level-0 compaction(无序 SST 合并)和跨 level 合并。默认参数针对通用场景,但如果你的 workload 是“每秒写 5K key,key 很小(

实操建议:

  • 增大 options.level0_file_num_compaction_trigger(默认 4 → 试试 8~12):让 level-0 积累更多文件再触发 compaction,降低频率
  • 同步调大 options.max_bytes_for_level_base(默认 256MB → 512MB 或 1GB):避免 level-1 过早满,减少 level-0→level-1 的倾倒压力
  • 禁用 options.compaction_pri = rocksdb::kMinOverlappingRatio(默认)→ 改用 kByCompensatedSize:对小 value 场景更公平,防止大 value 文件长期滞留

注意:max_bytes_for_level_base 必须是 target_file_size_base 的整数倍,否则 RocksDB 启动时静默忽略该配置。

LSM 的复杂性不在代码实现,而在参数与 workload 的耦合。一个 WriteOptions.sync = true 的误用,可能让吞吐跌 10 倍;而一个没开的 cache_index_and_filter_blocks,会让读延迟毛刺藏得极深——它们不会报错,只会默默拖垮性能。

相关文章

数码产品性能查询
数码产品性能查询

该软件包括了市面上所有手机CPU,手机跑分情况,电脑CPU,电脑产品信息等等,方便需要大家查阅数码产品最新情况,了解产品特性,能够进行对比选择最具性价比的商品。

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
C++ 高级模板编程与元编程
C++ 高级模板编程与元编程

本专题深入讲解 C++ 中的高级模板编程与元编程技术,涵盖模板特化、SFINAE、模板递归、类型萃取、编译时常量与计算、C++17 的折叠表达式与变长模板参数等。通过多个实际示例,帮助开发者掌握 如何利用 C++ 模板机制编写高效、可扩展的通用代码,并提升代码的灵活性与性能。

10

2026.01.23

php远程文件教程合集
php远程文件教程合集

本专题整合了php远程文件相关教程,阅读专题下面的文章了解更多详细内容。

29

2026.01.22

PHP后端开发相关内容汇总
PHP后端开发相关内容汇总

本专题整合了PHP后端开发相关内容,阅读专题下面的文章了解更多详细内容。

21

2026.01.22

php会话教程合集
php会话教程合集

本专题整合了php会话教程相关合集,阅读专题下面的文章了解更多详细内容。

21

2026.01.22

宝塔PHP8.4相关教程汇总
宝塔PHP8.4相关教程汇总

本专题整合了宝塔PHP8.4相关教程,阅读专题下面的文章了解更多详细内容。

13

2026.01.22

PHP特殊符号教程合集
PHP特殊符号教程合集

本专题整合了PHP特殊符号相关处理方法,阅读专题下面的文章了解更多详细内容。

11

2026.01.22

PHP探针相关教程合集
PHP探针相关教程合集

本专题整合了PHP探针相关教程,阅读专题下面的文章了解更多详细内容。

8

2026.01.22

菜鸟裹裹入口以及教程汇总
菜鸟裹裹入口以及教程汇总

本专题整合了菜鸟裹裹入口地址及教程分享,阅读专题下面的文章了解更多详细内容。

55

2026.01.22

Golang 性能分析与pprof调优实战
Golang 性能分析与pprof调优实战

本专题系统讲解 Golang 应用的性能分析与调优方法,重点覆盖 pprof 的使用方式,包括 CPU、内存、阻塞与 goroutine 分析,火焰图解读,常见性能瓶颈定位思路,以及在真实项目中进行针对性优化的实践技巧。通过案例讲解,帮助开发者掌握 用数据驱动的方式持续提升 Go 程序性能与稳定性。

9

2026.01.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
C# 教程
C# 教程

共94课时 | 7.4万人学习

C 教程
C 教程

共75课时 | 4.2万人学习

C++教程
C++教程

共115课时 | 13.4万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号