HMS JVM 사용량이 급격히 증가해 장애가 발생하고, 별도 시험에서는 Hive CREATE/DROP 이후 Impala 반영까지 수 초 지연된다.
원본은 metadata 전파가 수 초 걸리는 흐름을 로그로 확인했다. HMS 최초 메모리 장애의 객체 점유 원인과 최종 해결은 미확인이다.
HMS 메모리 장애와 비동기 metadata 전파 지연을 분리한다. OOM 증거·통계/partition 작업 부하를 확인해 조정하고, 의존 작업은 필요한 테이블만 명시적으로 갱신한다.
확인 수준: 추가 조사 해법 · 해당 케이스 적용 결과 미확인
적용 조건: <...>와 예시 DB·테이블·경로·수치는 실제 확인값으로 바꾼다. 명령과 메뉴는 참고 문서를 바탕으로 보강한 예시이며 대상 시스템에서 실행하지 않았다. 버전·원인에 따른 분기와 남은 확인 사항은 아래에 명시한다.
oom_heap_dump_enabled와 heap dump 경로를 확인한다. dump에는 민감한 값이 포함될 수 있으므로 서비스 계정 전용 경로와 최대 힙 이상 디스크 여유를 준비하고 필요한 역할 변경을 적용한다. 강제 dump 수집은 중단 영향을 별도로 평가한다.SET hive.stats.autogather;
SET hive.stats.column.autogather;
SET hive.stats.autogather=false;
INVALIDATE METADATA `database_name`.`new_table`;
-- 기존 테이블의 외부 파일 변경 반영
REFRESH `database_name`.`existing_table`;
HMS의 같은 부하에서 heap·GC 안정성과 재시작 여부를 확인하고 Hive 변경 후 Impala 조회 성공까지의 지연을 별도 측정한다.