Kudu 데이터 쏠림을 해소할 때 Rebalance 부하가 큰 증상이 나타난다.
동시 replica 이동 수를 줄여 디스크·네트워크 부하를 낮추는 운영 조치다. 해당 옵션의 값은 작업 시간과 부하를 고려해 조정한다.
Kudu Rebalance의 --max_moves_per_server를 낮은 값인 1 또는 2로 제한하고 --max_run_time_sec로 유지보수 시간 안에서 실행되도록 제한한다.
명령 예시는 문서 작성 시 보강한 것이며 대상 시스템에서 실행 검증하지 않았다.
KUDU_MASTERS='master1.example.com:7051,master2.example.com:7051,master3.example.com:7051'
kudu cluster ksck "$KUDU_MASTERS"
kudu cluster rebalance "$KUDU_MASTERS" --report_only
kudu cluster rebalance "$KUDU_MASTERS" --max_moves_per_server=1 --max_run_time_sec=1800
1800은 30분 작업 창의 예시다. 디스크 지연과 네트워크 사용을 관찰하고 여유가 있으면 다음 실행에서 동시 이동 수를 2로 늘린다.replica skew 감소, under-replication 부재, 서비스 지연이 허용 범위인지 확인한다.