知识类型
全部知识
共 31 篇Kubernetes Pod 异常排查手册
从 Pending、CrashLoopBackOff 与探针失败入手,串联事件、容器日志和资源状态,建立 Kubernetes 故障排查的证据链。
MySQL 复制延迟的定位方法
结合复制线程、GTID、事务积压与资源指标分析 MySQL 复制延迟,区分接收异常、回放瓶颈和监控误判。
HDFS 容量与副本健康巡检
使用 HDFS 报告和指定路径检查,识别 DataNode 容量倾斜、副本不足与文件损坏,记录 Hadoop 集群的日常健康基线。
集中日志平台的采集与存储设计
规划 Fluent Bit、Elasticsearch 与 Kibana 的日志链路,明确字段、缓冲、保留周期和权限,并设计丢失与重复检测。
Uptime Kuma 可用性探测与通知验收
从探测点网络、健康检查规则、通知演练和 data 目录备份出发,验收 Uptime Kuma 是否真能发现故障并安全展示状态页。
ClickHouse 增量物化视图与历史回填防重
理解 ClickHouse 插入触发与目标表聚合,通过明确切点、隔离回填和批次清单核验历史覆盖,防止双路径重复及维表误判。
StarRocks 物化视图刷新与数据新鲜度
按任务链和分区覆盖解释 StarRocks 异步视图刷新,区分同步调用、透明重写与陈旧容忍,核对维表修订和业务截止点。
Doris 物化视图刷新与透明重写验收
区分同步维护与异步分区刷新,串联 Doris 视图状态、Job/Task、重写计划和业务分区对账,验证新鲜度与维护成本。
ClickHouse 副本巡检与备份恢复
按本地表和分片巡检复制队列与 Keeper,核对原生备份依赖链,并在隔离目标验证恢复状态与业务样本。
ClickHouse 查询与内存瓶颈诊断
关联 Query Log、运行中内存与 EXPLAIN,定位扫描、聚合、排序和 JOIN 放大,并验证分布式查询资源预算。
ClickHouse MergeTree 数据组织与建模
从排序键、分区与数据 Part 设计分析表,解释 ReplacingMergeTree、重试去重和 TTL 的正确性及合并成本。
Flink 反压与 Watermark 停滞诊断
从子任务忙碌、空闲和反压指标定位慢链路,区分输入积压与事件时间停滞,验证迟到处理和恢复代价。
Topic Collections
知识专题导航
Knowledge FAQ
常见问题 FAQ
如何找到适合当前问题的知识文章?
可先使用关键词搜索,再结合文章类型、分类、标签与难度缩小范围;筛选条件会保留在网址中,便于分享和再次访问。
文章中的操作步骤可以直接用于生产环境吗?
知识内容用于经验复用与方案参考。生产操作前仍应结合自身环境完成评审、备份、验证与回滚准备。
知识内容如何保持更新?
后台发布或更新文章后,公开列表、正文和知识更新记录会同步;归档内容不再出现在公开列表中。内置文章的导读、图解和判读补充随前端版本维护,调整正文时也需复核这些关联内容。
导读和架构图是否代表已经完成验证?
不代表。导读帮助理解原理,关联图解说明参考组件和连接关系;每篇会注明图解的适用范围。请以文章的验证说明为准,并在当前环境重新核对版本、权限、证据和回退边界。
如何参与知识内容建设?
具备内容权限的成员可从内容管理入口创建草稿,补充正文、标签和工具或场景关系,审核发布后即可公开检索。