대량 HDFS 파일 또는 snapshot 삭제가 다른 작업을 오래 지연시키는 증상이 나타난다.
파일 개수의 고정 상한은 제시되지 않았으며 각 삭제가 수 초 이상 길어지지 않도록 작업을 분산하는 방법이 안내되었다.
삭제 대상을 작은 배치로 나누어 순차 처리해 한 번의 삭제 작업이 오래 실행되지 않도록 한다.
명령 예시는 문서 작성 시 보강한 것이며 대상 시스템에서 실행 검증하지 않았다.
hdfs dfs -count -q '<target-directory>'
hdfs lsSnapshottableDir
time hdfs dfs -rm -r '<확인한-단일-파티션-경로>'
-skipTrash를 무조건 사용하지 않는다.hdfs dfs -deleteSnapshot <root> <snapshot-name>으로 삭제한다. 파일 수 기준의 고정 안전 임계값은 원본에 없다.배치별 처리 시간과 NameNode RPC latency가 허용 범위인지 확인한다.