Global Search
搜索整个运维生态
一次检索工具、生态包、场景、知识、项目和文档,直接进入可以执行的答案。
- 场景
Redis Sentinel 高可用
从主从数据基线、Sentinel 多数授权到客户端发现和故障演练,明确异步复制与新主接写后的恢复边界。
- 场景
PostgreSQL 高可用
用 Patroni、etcd 与 HAProxy 建立 PostgreSQL 单主访问链路,明确复制一致性、旧主隔离和恢复验收。
- 场景
MySQL 主从高可用
围绕 GTID 复制、旧主隔离、代理入口和受控切换,建立有一致性检查与恢复边界的 MySQL 高可用流程。
- 场景
GitLab 备份与隔离恢复演练
核对 GitLab 数据、配置、密钥与对象存储备份,在同版本隔离实例验证仓库、权限和附件,建立可审阅的恢复证据。
- 场景
Redis 内存压力与延迟处置
区分 maxmemory、进程 RSS、复制与 AOF 缓冲,结合有界采样、慢日志和业务指标定位 Redis 内存压力及延迟。
- 场景
PostgreSQL 时间点恢复演练
在隔离空实例中核验完整基础备份、连续 WAL 与时间线,按明确时区暂停至目标点,完成数据抽样和恢复证据交接。
- 场景
etcd 快照与隔离恢复演练
以 etcd 3.6 工具链验证快照可恢复性,覆盖完整性、隔离新集群、revision 边界、客户端验收和回退停止点。
- 场景
Kubernetes DNS 与 Service 连通性排障
从只读对象证据出发,分离 DNS、Service、后端与网络策略故障,经过授权探测和最小变更验证恢复。
- 场景
Kafka 集群监控
围绕 Kafka broker、KRaft 控制面与消费积压搭建受限指标采集,形成分级告警和可复核的业务基线。
- 场景
Hadoop DataNode 下线
以 HDFS 正式退役流程迁移 DataNode 副本,核对容量、机架与业务负载后再停止服务并交接资产。
- 场景
Docker 镜像管理
建立镜像来源、摘要、扫描、仓库访问和保留规则,验证制品可拉取、可恢复且清理范围可解释。