CORE CONCEPTS · 宽列数据库
Apache Cassandra 核心知识
Cassandra 要按查询反向设计表。分区键、聚簇顺序、一致性级别、压缩和 tombstone 是性能与可靠性的共同基础。
学完应该能做到
- 能设计有界分区
- 能计算一致性条件
- 能治理 compaction 与 tombstone
三个必须建立的心智模型
查询驱动建模
每张表服务明确查询,分区键定位节点,聚簇列定义分区内排序。
- 避免跨分区扫描
- 限制分区大小
- 为每个访问模式建表
一致性与修复
副本数 N、读写一致性 R/W 决定可用性与一致性;repair 修复副本差异。
- 记录 consistency level
- 规划增量 repair
- 处理 hinted handoff 边界
LSM、压缩与 Tombstone
写入先到 memtable/WAL,再形成 SSTable;删除产生 tombstone,压缩负责合并。
- 按工作负载选 UCS/STCS/LCS
- 避免 tombstone storm
- 监控 pending compaction
把知识落到工程决策
建模前
先写出访问模式、正确性边界、数据生命周期和故障预算,再决定表、键、索引或分区。
上线前
使用接近生产的数据分布与并发压测,记录查询计划、资源水位和恢复时间作为基线。
运行中
监控延迟分位数、容量增长、后台维护与复制健康;报警必须能映射到可执行处置步骤。