生态入口
热门工具
运维场景
查看全部场景Kubernetes 集群监控
从对象清单、指标覆盖和资源预算开始,打通采集、看板、分级告警、故障演练及值班交接。
已收录 7 个步骤服务器安全检查与加固
以资产证据和备用管理通道为起点,逐项整改账号、SSH、服务和日志策略,并通过灰度与回归验证控制影响。
已收录 7 个步骤MySQL 主从高可用
围绕 GTID 复制、旧主隔离、代理入口和受控切换,建立有一致性检查与恢复边界的 MySQL 高可用流程。
已收录 7 个步骤Hadoop 集群运维
结合 HDFS 块健康、节点容量与 YARN 队列证据,建立巡检、监控、单节点维护和恢复验收流程。
已收录 7 个步骤日志集中管理
从日志字段、采集位点与缓冲预算到索引生命周期和端到端测试,建设能够衡量延迟、重复与丢失的日志链路。
已收录 7 个步骤Redis Sentinel 高可用
从主从数据基线、Sentinel 多数授权到客户端发现和故障演练,明确异步复制与新主接写后的恢复边界。
已收录 7 个步骤知识沉淀
- Kubernetes Pod 异常排查手册Kubernetes监控告警
- Linux 主机安全基线检查清单Linux安全加固
- MySQL 复制延迟的定位方法MySQL监控告警
- HDFS 容量与副本健康巡检Hadoop大数据
- 集中日志平台的采集与存储设计Elasticsearch日志管理
- Redis Sentinel 的仲裁与客户端接入Redis高可用
- Uptime Kuma 可用性探测与通知验收Docker告警治理
- Doris、StarRocks 与 ClickHouse 指标一致性对账Apache DorisClickHouse
项目与实验室
查看全部项目豆芽 OPS 生态网站
以 Go API、Nuxt SSR 和 PostgreSQL 构建的运维内容平台,贯通工具、场景、知识、项目与层级文档,提供管理员发布、搜索及单机 Compose 交付流程。
Linux 主机监控集成实践
围绕主机指标、分层看板与责任路由整理可审阅的集成方案,提供试点部署和运行验收文档。
Kubernetes 日志集成实践
整理容器日志采集、位点与缓冲、索引治理及检索隔离方案,配套部署和异常处置手册。
Ansible 主机基线实践
整理 Linux 主机分组、最小权限、配置灰度与可恢复验收,形成待目标环境验证的 Ansible 集成方案。
数据库高可用演练实验室
分别规划 MySQL、PostgreSQL 与 Redis 的隔离演练,围绕单写权威、故障切换、事务核对及备份恢复建立证据清单。
文档中心
查看全部文档最新动态
查看全部更新新增 Uptime Kuma 知识库指南,覆盖探测规则验收、通知渠道配置、反向代理与数据备份回退。
新增 Uptime Kuma 站点可用性探测实战场景,包含部署、试点监控、通知演练、状态页发布与数据备份交接。
新增 Uptime Kuma 工具条目,补充探测类型、反向代理、Docker socket 风险、通知演练、备份升级与官方参考。
补充运维场景配套知识,含官方参考、验收与回退边界;环境验证状态为待验证。
补充运维场景配套知识,含官方参考、验收与回退边界;环境验证状态为待验证。