知识类型
全部知识
共 34 篇HDFS 容量与副本健康巡检
使用 HDFS 报告和指定路径检查,识别 DataNode 容量倾斜、副本不足与文件损坏,记录 Hadoop 集群的日常健康基线。
Doris、StarRocks 与 ClickHouse 指标一致性对账
围绕共同快照、业务键、时区、NULL、金额精度与维表版本建立跨引擎对账,避免用总额相等掩盖重复、遗漏和口径差异。
ClickHouse 增量物化视图与历史回填防重
理解 ClickHouse 插入触发与目标表聚合,通过明确切点、隔离回填和批次清单核验历史覆盖,防止双路径重复及维表误判。
StarRocks 物化视图刷新与数据新鲜度
按任务链和分区覆盖解释 StarRocks 异步视图刷新,区分同步调用、透明重写与陈旧容忍,核对维表修订和业务截止点。
Doris 物化视图刷新与透明重写验收
区分同步维护与异步分区刷新,串联 Doris 视图状态、Job/Task、重写计划和业务分区对账,验证新鲜度与维护成本。
Flink CDC Schema 事件、目标表演进与恢复边界
辨别 Pipeline 结构事件、演进策略、类型和路由契约,联查目标 DDL 与后续数据,验证 checkpoint 恢复不能撤销外部结构变化的边界。
Flink CDC 增量快照、Binlog 衔接与一致性验证
拆解 MySQL 增量快照的分块与日志位置衔接,核对 CDC 版本、源端保留和恢复状态,按主键及删除样本验证下游一致性。
Kafka 生产者确认、幂等与事务交付语义
从 acks、ISR、幂等重试与事务提交解释 Kafka 交付边界,用有限事件样本区分记录重复、分区顺序和外部业务副作用。
Kafka KRaft 仲裁、元数据日志与控制面巡检
区分 KRaft 投票成员、发现地址与功能级别,通过有限仲裁采样和元数据日志趋势判断控制面健康,明确多数派、节点身份及停止维护的条件。
Iceberg Spark 写入与文件维护
区分文件落盘与原子提交,在隔离小表演练数据重写和 orphan 预览,核对业务幂等、保留与恢复边界。
Iceberg 表元数据、快照与时间旅行
理解 catalog、metadata、manifest 与文件引用链,用有限元数据查询验证快照关系、时间旅行和历史保留条件。
Hive SQL 编译、调度与执行诊断
沿 HiveServer2、Metastore、YARN 与 Tez 解释查询耗时,核对裁剪、统计和 Join 长尾,以固定输入验收优化。
Topic Collections
知识专题导航
Knowledge FAQ
常见问题 FAQ
如何找到适合当前问题的知识文章?
可先使用关键词搜索,再结合文章类型、分类、标签与难度缩小范围;筛选条件会保留在网址中,便于分享和再次访问。
文章中的操作步骤可以直接用于生产环境吗?
知识内容用于经验复用与方案参考。生产操作前仍应结合自身环境完成评审、备份、验证与回滚准备。
知识内容如何保持更新?
后台发布或更新文章后,公开列表、正文和知识更新记录会同步;归档内容不再出现在公开列表中。内置文章的导读、图解和判读补充随前端版本维护,调整正文时也需复核这些关联内容。
导读和架构图是否代表已经完成验证?
不代表。导读帮助理解原理,关联图解说明参考组件和连接关系;每篇会注明图解的适用范围。请以文章的验证说明为准,并在当前环境重新核对版本、权限、证据和回退边界。
如何参与知识内容建设?
具备内容权限的成员可从内容管理入口创建草稿,补充正文、标签和工具或场景关系,审核发布后即可公开检索。