央视新闻
边缘存储:就近缓存与热数据加速 边缘存储的核心思路是将高频访问的“热数据”部署在距离用户最近的节点上
同时,边缘存储还承担着 写操作缓存 的🔍职责:用户行为数据、点击反馈等先写入边缘层,再异步批量同步至中心数据库,避免了瞬时写入洪峰对数据库的直接冲击
传统单体架构下🎇,存储与▶️计算紧密耦合,导致扩展性受限、性能瓶颈频现
在百度搜索引擎中,索引更新(写操作)频率远低于用户查询(读操作),因此📌将主库专用于索引构建与增量更新,而部署多个从库副本承担查询负载,是常见做法
百度搜索采用“最🎊终一致性为主+关键场🎯景强一致性”的策略,例如用户更新账户密码时需强一致,而普通查询可接受秒级延迟
分片键的选取是设计成败的关键:若选择不当,可能导致数据倾斜,使得某些🎯分片成🎇为热点瓶颈
这种设计将随机写转化为顺序写📌,极大🚀提升了磁盘IO效率
当单库容量达到瓶颈时🚀,水平分片(Sharding)将索引数据按 关键词哈希范围 或 文档🌅ID区间 划分为多个分片,每个分片独立部署数据库实例
日志结构化合并与分层存储 在索引更新场景中,数据库分离架构常与 日志结构化合并树(LSM-Tree) 结合使用
这些设计使得系统能够容忍单节点甚至跨机架的故障,维持99
运维复杂度: 分离🎆架构引入更多组件(缓存、消息队列、分片代理等🌅),需要配套自动化监控与运维平台
数据库分离:读写分离与分片策略 数据库分离架构🎆主要包含两个维度: 读写分离 与 水平分片
高可用与故障恢复机制🎊 架构分离增加了系统节点数量😎,也带来了更高的故障概率