知识类型
全部知识
共 13 篇HDFS 容量与副本健康巡检
使用 HDFS 报告和指定路径检查,识别 DataNode 容量倾斜、副本不足与文件损坏,记录 Hadoop 集群的日常健康基线。
10 亿数据如何快速插入 MySQL
优先考虑批量文件导入而非多线程 INSERT,从数据预处理与分片、保留主键延后二级索引、LOAD DATA 或 MySQL Shell 并行导入,到分片校验、后建索引和硬件选型,给出 10 亿行级 InnoDB 导入的落地方案与失败恢复设计。
Doris、StarRocks 与 ClickHouse 指标一致性对账
围绕共同快照、业务键、时区、NULL、金额精度与维表版本建立跨引擎对账,避免用总额相等掩盖重复、遗漏和口径差异。
Doris 物化视图刷新与透明重写验收
区分同步维护与异步分区刷新,串联 Doris 视图状态、Job/Task、重写计划和业务分区对账,验证新鲜度与维护成本。
Flink CDC Schema 事件、目标表演进与恢复边界
辨别 Pipeline 结构事件、演进策略、类型和路由契约,联查目标 DDL 与后续数据,验证 checkpoint 恢复不能撤销外部结构变化的边界。
Kafka 生产者确认、幂等与事务交付语义
从 acks、ISR、幂等重试与事务提交解释 Kafka 交付边界,用有限事件样本区分记录重复、分区顺序和外部业务副作用。
Hive Metastore 与分区登记治理
核对 Hive 表类型、分区登记、HMS 持久化与真实目录,区分元数据修复、ACID 维护和数据恢复边界。
StarRocks Stream Load 与主键更新实践
核对 Stream Load 结果、Primary Key 与条件更新语义,辨别部分更新和 Merge Commit 的确认边界,防止乱序覆盖与重复推进。
Hadoop 小文件治理与数据一致性验收
从文件增长来源、元数据与查询成本选择合并或归档方案,在独立候选目录验证语义、性能和发布回退条件。
Harbor 保留规则与 GC 安全检查
核对运行与回退镜像摘要,区分保留规则、不可变策略和垃圾回收,以双重预演、独立审批和冷拉取防止误删。
需求、接口、代码到值班交接的关联方法
以禅道需求为起点,把 YApi 契约、GitLab 评审与 Confluence 或语雀交接组织成可追溯流程,明确 Mock、版本和权限边界。
Ansible 初始化的资产核对与幂等故障诊断
将批量初始化中的目标偏差、连接失败、解释器错误和重复变更拆开核验,以单机证据定位问题并保留已完成、部分完成和未执行主机的恢复边界。
Topic Collections
知识专题导航
Knowledge FAQ
常见问题 FAQ
如何找到适合当前问题的知识文章?
可先使用关键词搜索,再结合文章类型、分类、标签与难度缩小范围;筛选条件会保留在网址中,便于分享和再次访问。
文章中的操作步骤可以直接用于生产环境吗?
知识内容用于经验复用与方案参考。生产操作前仍应结合自身环境完成评审、备份、验证与回滚准备。
知识内容如何保持更新?
后台发布或更新文章后,公开列表、正文和知识更新记录会同步;归档内容不再出现在公开列表中。内置文章的导读、图解和判读补充随前端版本维护,调整正文时也需复核这些关联内容。
导读和架构图是否代表已经完成验证?
不代表。导读帮助理解原理,关联图解说明参考组件和连接关系;每篇会注明图解的适用范围。请以文章的验证说明为准,并在当前环境重新核对版本、权限、证据和回退边界。
如何参与知识内容建设?
具备内容权限的成员可从内容管理入口创建草稿,补充正文、标签和工具或场景关系,审核发布后即可公开检索。