L1
存储原理
块 / 文件 / 对象与冗余机制建立分布式存储的通用心智模型:数据怎么切、怎么冗余、故障时怎么恢复,换任何一款产品都通用。
5 节课 · 约 2 小时已完成 0/5
- 1
块、文件、对象:三种存储语义
原理25 分钟不是三种产品,是三种访问语义。选错语义,后面怎么调优都别扭。
- →用一句话说清三种存储各自暴露给应用的是什么
- →给定业务场景,判断应该用块、文件还是对象
- →解释为什么对象存储天然易扩展而文件存储难
- 2
副本还是纠删码:冗余机制的取舍
原理35 分钟三副本浪费 67% 空间,EC 省空间但重建时能把集群拖垮。这节课算清这笔账。
- →计算任意副本数 / EC 方案的空间效率与故障容忍度
- →解释 EC 的读放大、写放大与重建代价
- →给出"什么场景用副本、什么场景用 EC"的判断依据
- 3
一致性、故障域与可用性
原理30 分钟CAP 不是屠龙术,它每天都在决定你的集群在断电时丢不丢数据。
- →区分强一致、最终一致在运维上的可观察差异
- →按机架/电源/交换机划分故障域
- →解释 quorum 与脑裂,并说明为什么监控节点要奇数个
- 4
硬件基础:从 NAND 到整机选型
原理30 分钟写放大、寿命、掉电保护,这些盘的特性会一路传导到集群指标上。
- →解释 SSD 写放大、GC、TRIM 与稳态性能
- →看懂 DWPD、TBW 并据此估算盘的寿命
- →为存储节点搭配合理的 CPU / 内存 / 盘位 / 网卡
- 5
存储协议与接入方式
原理25 分钟iSCSI、NFS、S3、NVMe-oF 各自的开销与坑,接入前先知道。
- →为给定业务选择接入协议并说明理由
- →排查 NFS 挂载卡死、S3 签名失败一类常见故障
- →理解多路径与客户端侧缓存的影响