¶
Cloudera 문제 해결
제품 문서는
Cloudera
에 있다.
¶
하위 문서
¶
Agent Studio 가 CML API 호출에서 Missing Authority Key Identifier 로 실패하는 증상
¶
CDE Airflow Job 을 만들 수도 지울 수도 없는 증상 — 고아 DAG
¶
CDE secret creation
¶
CM과 AD 연동 후 LDAP 사용자 로그인이 실패하는 증상
¶
특정 호스트만 Certificate Expiration 점검이 해제됐다고 나오는 증상
¶
CDP 업그레이드 후 CM Agent가 core dump를 만들며 반복 재시작되는 증상
¶
CM Agent에 host with ID that is not recognized 오류가 발생하는 증상
¶
CM Agent에 JSONDecodeError가 발생하고 Impala 프로세스 상태가 갱신되지 않는 증상
¶
CM의 Impala Query Monitoring Status Check 경고가 계속 표시되는 증상
¶
CM에서 Kafka Broker Role Log File 화면을 불러오지 못하는 증상
¶
CM에 Memory Overcommit Validation 경고가 발생하는 증상
¶
CM Metric 정보가 수집되지 않을 때
¶
Redaction rules file doesn not exist 메시지
¶
Service Monitor 차트가 주기적으로 끊기고 재시작되는 증상
¶
CM Service Monitor가 Impala 쿼리 정보를 수집하지 못하는 증상
¶
Service Monitor를 다른 노드로 옮겨야 하는 증상
¶
폐쇄망 CML 홈 화면이 외부 콘텐츠 URL에 접근하는 증상
¶
CAI 세션과 CDE 작업이 Pending 또는 ApplicationRejected에 머무는 증상
¶
CAI Application 접속이 특정 ingress에서 로그인 화면으로 돌아가는 증상
¶
한글로만 만든 CAI 프로젝트에 접근하거나 삭제하지 못하는 증상
¶
폐쇄망 CDSW에서 새 ML Runtime 이미지가 보이지 않는 증상
¶
CDSW 인증 방식을 잘못 변경한 뒤 기존 로컬 관리자로 로그인하지 못하는 증상
¶
CDSW 세션에서 conda로 설치한 Python 모듈을 인식하지 못하는 증상
¶
CDSW에서 Git 저장소를 복제해 프로젝트를 만들지 못하는 증상
¶
CDSW 모델 빌드가 프로젝트와 Git 저장소 디렉터리 권한 때문에 실패하는 증상
¶
CDSW 모델 빌드에서 s2i-client 임시 공간 문제로 생성이 실패하는 증상
¶
CM 업그레이드 후 Python3 호환 문제로 CDSW가 동작하지 않는 증상
¶
CDSW에서 잘못된 Hadoop 설정 때문에 SparkSession 생성이 실패하는 증상
¶
CDSW TLS 인증서가 서비스 하위 도메인을 포함하지 않는 증상
¶
CDSW 사용자 동기화 후 ML Admin 역할이 초기화되는 증상
¶
Grafana에서 CDSW Worker 메트릭이 보이지 않는 증상
¶
CML 모델 빌드가 weka invalid argument 오류로 실패하는 증상
¶
H100에서 NIM 임베딩 모델의 응답이 지연되는 증상
¶
Exit Code 34 while starting CML sessions
¶
CML 세션 터미널에서 vi 명령을 찾을 수 없는 증상
¶
CML Workbench에서 편집 중인데도 세션이 idle timeout으로 종료되는 증상
¶
CML Workspace가 getconfig 500 또는 base64 400 오류로 기동되지 않는 증상
¶
CDP 진단 번들을 생성하지 못하고 data-0 공간이 가득 찬 증상
¶
CDP DS 내장 PostgreSQL 인증서가 만료되는 증상
¶
External Docker Registry Canary가 잘못된 호스트에 접속하는 증상
¶
CDP DS에서 여러 User Search Base 사용 시 LDAP 로그인이 불안정한 증상
¶
ECS 업그레이드가 helm 패키지 path not found로 실패하는 증상
¶
Vault가 Sealed 상태로 시작되지 않는 증상
¶
AKS 인증서 갱신 후 CDP에서 클러스터에 접속하지 못하는 증상
¶
Atlas에서 No groups found for user HTTP 오류가 발생하는 증상
¶
CDP 7.1.6 업그레이드 후 Atlas Web UI가 servlet-api.jar를 찾지 못하는 증상
¶
번들 Tomcat 8.5.x의 지원 종료 취약점 조치가 필요한 증상
¶
CDE에서 LDAP 로그인이 실패하는 증상
¶
LDAP 인증이 다른 서비스에서는 되지만 CDW Activation만 실패하는 증상
¶
CDW Trino가 존재하지 않는 truststore를 찾으며 시작되지 않는 증상
¶
Data Lake가 node failure 상태인데 CM 호스트는 살아 있는 증상
¶
jackson-mapper-asl 취약점이 CDP 번들에서 탐지되는 증상
¶
MariaDB query_cache 경합으로 메타데이터 DB 성능이 저하되는 증상
¶
Flink 작업 제출 시 ZooKeeper SASL 설정이 없다는 오류가 나는 증상
¶
HBase Active Master의 메모리 사용량이 계속 증가하는 증상
¶
Ambari의 HBase Region Average Load가 실제와 다르게 표시되는 증상
¶
HBase meta Region이 오랫동안 RIT에 머무는 증상
¶
CDP 업그레이드 후 HBase periodic memstore flush 지연 설정이 남아 있는 증상
¶
HBase region health 검사에서 WAL 경로 관련 경고가 발생하는 증상
¶
HBase RegionServer의 File Descriptor가 계속 증가하는 증상
¶
HBase replication peer 제거 시 RegionServer가 종료되는 증상
¶
HDP 3.1 HBase 스캔에서 CPU 사용률이 급증하는 증상
¶
HDP 3.1.0 HBase 스캔 중 RegionServer가 SIGSEGV로 종료되는 증상
¶
HBase snapshot 복사 후 archive 파일 삭제로 테이블 복구가 실패하는 증상
¶
HBase Thrift에서 읽기 전용 설정이 적용되지 않는 증상
¶
Ambari HDFS의 TOTAL FILES DIRECTORIES가 n/a로 표시되는 증상
¶
대량 HDFS 파일 또는 snapshot 삭제가 다른 작업을 오래 지연시키는 증상
¶
호스트 IP 변경 후 DataNode가 CM에 정상 등록되지 않는 증상
¶
HDFS 파일을 삭제해도 파일과 디렉터리 개수가 줄지 않는 증상
¶
LDAP 그룹 매핑 설정 후 Java 모듈 접근 오류로 서비스가 시작되지 않는 증상
¶
Load Balancer 주소로 접속한 Beeline 연결이 잠시 후 끊기는 증상
¶
Load Balancer를 통한 Beeline Kerberos 인증이 실패하는 증상
¶
CDW Database Catalog에서 Error Code 9999가 발생하는 증상
¶
Hive 업그레이드 후 CREATE TABLE의 기본 테이블 유형이 달라지는 증상
¶
Elasticsearch storage handler 테이블의 CREATE 또는 DROP이 실패하는 증상
¶
Hive의 HCatalog JsonSerDe 클래스를 찾지 못해 JSON 적재가 실패하는 증상
¶
MySQL failover 중 HMS Heap이 증가하고 Hive가 응답하지 않는 증상
¶
HiveServer2가 Heap 부족으로 간헐적으로 종료되는 증상
¶
HiveServer2에서 operation log 때문에 File Descriptor가 누수되는 증상
¶
Hive JOIN 결과에서 한글이 물음표로 표시되는 증상
¶
CDP 업그레이드 후 Hive Metastore Canary 검사가 실패하는 증상
¶
Hive Parquet 테이블이 Sqoop 원본 파일보다 크게 저장되는 증상
¶
파티션이 많은 테이블에서 SELECT LIMIT 이 컴파일 단계에서 지연되는 증상
¶
YARN Timeline Service 사용 시 Hive 쿼리 실행이 지연되는 증상
¶
Hive 쿼리 계획 수립 중 Heap이 급증하고 HiveServer2가 종료되는 증상
¶
특정 HiveServer2에 연결할 때 Hive 쉘이 멈추는 증상
¶
Hive 통계 수집 중 PARTITION_PARAMS INSERT 오류가 발생하는 증상
¶
하위 디렉터리가 있는 데이터를 Hive로 읽거나 가져올 때 오류가 발생하는 증상
¶
Hive sys.db의 query_data 오래된 파일이 삭제되지 않는 증상
¶
NameNode HA 전환 후 Hive가 테이블 경로에 접근하지 못하는 증상
¶
Host is not connect hostmonitor
¶
hue 명령 실행 시 --cm-managed 를 쓰라는 경고가 반복되는 증상
¶
CDP 업그레이드 중 Error loading MySQLdb module 오류가 나는 증상
¶
Hue Impala Editor 쿼리가 원하는 리소스 풀에서 실행되지 않는 증상
¶
Hue에서 Impala 쿼리 결과를 NAS에 직접 저장하지 못하는 증상
¶
Hue Index 또는 Job Browser 접속 시 SSL 오류가 발생하는 증상
¶
Hue PySpark Editor에서 Spark3 코드가 실행되지 않는 증상
¶
Impala Array 컬럼 JOIN 또는 서브쿼리 실행 시 오류와 Daemon 종료가 발생하는 증상
¶
Catalog 메타데이터가 JVM 배열 한도를 넘어 OOM으로 종료되는 증상
¶
SSL 비활성화 후 Impala Catalog의 26000 포트가 열리지 않는 증상
¶
Impala에 Could not acquire lock for topic catalog-update 오류가 발생하는 증상
¶
Azure 기반 Impala Virtual Warehouse 업그레이드가 자격 증명 오류로 실패하는 증상
¶
CDW Impala Coordinator가 메모리 부족으로 간헐적으로 종료되는 증상
¶
CDW Impala 접속에 HTTP 504 또는 연결 끊김이 발생하는 증상
¶
줄 끝 개행이 없는 텍스트 테이블 조회 중 Impala Coordinator가 종료되는 증상
¶
Impala Coordinator가 새 쿼리 연결을 받지 못하는 증상
¶
CM 7.7.1에서 Impala Daemon이 종료되지 않아 재시작이 막히는 증상
¶
Impala 날짜 파티션 쿼리가 표현식 재작성 설정에 따라 실패하는 증상
¶
Impala 기본 풀에서 admission slot 제한으로 쿼리가 대기하는 증상
¶
메타데이터 변경 직후 Impala에 Failed to open HDFS file이 발생하는 증상
¶
Isilon 환경에서 Iceberg REFRESH가 다른 REFRESH까지 지연시키는 증상
¶
같은 Iceberg 테이블을 Spark와 Impala로 읽을 때 값이 다른 증상
¶
impalad 로그가 롤링되지 않고 계속 커지는 증상
¶
CDP 7.1.8 업그레이드 후 Impala JOIN 쿼리 성능이 저하되는 증상
¶
Cloudera ODBC · JDBC 드라이버에서 (1110) Unexpected response 오류가 나는 증상
¶
Impala가 Parquet TIMESTAMP를 기대와 다른 시간으로 처리하는 증상
¶
Impala 파티션 변경 때마다 메타데이터 재로딩과 커넥션 누수가 발생하는 증상
¶
Impala가 Ranger 정책을 정상적으로 불러오지 못하는 증상
¶
Impala 쿼리를 제출할 때마다 리소스 풀을 직접 지정해야 하는 증상
¶
업그레이드 후 Impala Statestore와 Catalog Daemon 정지가 끝나지 않는 증상
¶
업그레이드 후 Impala TOP-N 쿼리가 느려지는 증상
¶
Kafka Connect 재시작 후 등록한 커넥터가 사라지는 증상
¶
Kerberos HDFS에 연결하는 Kafka Connector 인증이 실패하는 증상
¶
Kafka Consumer heartbeat 불안정으로 반복 rebalance가 발생하는 증상
¶
Kafka listener가 서로 다른 네트워크에 있어 SMM이 동작하지 않는 증상
¶
SMM Broker 메트릭이 0으로 표시되는 증상
¶
SMM에서 Kafka Connect 커넥터를 만들었는데 토픽이 생성되지 않는 증상
¶
kafka-topics의 --zookeeper 옵션으로 토픽을 찾지 못하는 증상
¶
Cloudera Manager에 KDC_AVAILABILITY 오류가 발생하는 증상
¶
Kerberos가 RC4 티켓을 사용해 AES 전환이 필요한 증상
¶
Windows에서 Kerberos ksetup이 Access Denied로 실패하는 증상
¶
Kerberos 활성화 후 ZooKeeper가 No password provided로 시작되지 않는 증상
¶
Atlas의 Kudu 컬럼과 Technical Properties가 실제 테이블과 다른 증상
¶
Kudu flush와 compaction이 밀리면서 저장 공간 사용량이 커지는 증상
¶
Kudu 데이터 쏠림을 해소할 때 Rebalance 부하가 큰 증상
¶
OpenSSL 변경 후 Kudu가 자체 인증서를 생성하지 못하는 증상
¶
Kudu 호스트명 변경 후 기존 테이블을 갱신하지 못하는 증상
¶
com.cloudera.log4j.redactor 클래스를 찾지 못하는 증상
¶
Manually uninstall ECS
¶
NiFi에서 CDW Impala JDBC 접속 시 GSS initiate failed가 발생하는 증상
¶
CFM Operator 3.x 배포 시 ZooKeeper 구성 여부가 불명확한 증상
¶
NiFi 노드 재시작 후 클러스터 동기화가 오래 걸리는 증상
¶
NiFi 재시작 후 Controller Service가 비활성 상태에 머무는 증상
¶
손상된 template 때문에 NiFi가 재기동되지 않는 증상
¶
NiFi PutKudu가 큰 파일을 처리할 때 Heap OOM이 발생하는 증상
¶
NiFi PutKudu가 단순 INSERT에서도 권한 오류로 실패하는 증상
¶
NiFi 사용자·그룹 공급자 구성 후 Ranger 연동이 정상 동작하지 않는 증상
¶
Oozie SSH Action의 표준 출력 전달이 실패하는 증상
¶
JVM 부하가 줄어도 Swap 사용량이 내려가지 않는 증상
¶
Ranger 마스킹 정책에서 테이블 자동완성이 되지 않는 증상
¶
Spark 예제의 Executor에서 numpy 등 Python 라이브러리를 찾지 못하는 증상
¶
Spark3의 SnakeYAML에서 CVE-2022-1471이 탐지되는 증상
¶
Parcel 배포가 배포중 상태에서 멈출 때
¶
Trial license로 임시 조정
¶
YARN Application 로그 페이지에 접속하지 못하는 증상
¶
HDP 3.1 ATSv2 HBase가 설정한 메모리보다 많이 사용하는 증상
¶
YARN ResourceManager가 긴 GC 이후 종료되는 증상
¶
Timeline Server가 LevelDB 상태 파일 문제로 시작되지 않는 증상
¶
AI Registry 설치가 Installing Knox 에서 멈출 때 — 빈 knox-ca 와 도메인 라우팅
¶
Atlas 기동 실패 — HA JAAS 설정과 Solr 컬렉션 포트 불일치
¶
CAI 내장 레지스트리 인증 정보가 사용자 네임스페이스에 전파되지 않는 문제
¶
CAI 모델 빌드 실패: CoreDNS 포워딩과 레지스트리 CA
¶
CAI 세션에서 HDFS 가 안 될 때 — Hadoop CLI 애드온 · CoreDNS · 계정 잠김
¶
CAI 워크벤치 SAML 오류와 FreeIPA LDAP 매핑
¶
CAI 워크스페이스 프로비저닝 정체 — s2i-builder 레지스트리 인증서 panic 과 CrashLoop 진단
¶
CAII listClusterResources CORS·403 오류 — Istio Ambient 모드와 Knox ext-authz 비호환
¶
CAII 에서 gpt-oss 서빙 — Harmony 파서와 tool calling 실패
¶
CAII 엔드포인트가 응답하지 않을 때 — scale-to-zero 와 프로브 임계값
¶
CDE Job 스케줄 pause · unpause 와 Airflow 직접 제어 제한
¶
CDE Service 설치가 ClusterChartInstallationInProgress 에서 멈출 때
¶
CDE Spark Job 의 Hive Metastore Kerberos 실패 — Pod krb5.conf 에 realm 없음
¶
CDE TLS 인증서 — Service 와 Virtual Cluster 두 곳에 등록
¶
CDE keytab 등록 실패 — krb5.conf.d 의 KCM 기본 캐시 설정
¶
CDE 가상 클러스터 쿼터 초과 — YuniKorn 큐가 진짜 상한이다
¶
CDE 서비스 설치 실패 — clientconfigs ConfigMap 누락의 진짜 원인(dex_admin DB)
¶
CDP Data Services monitoring 파드 CrashLoop — cacerts ConfigMap 에 CA 추가
¶
CDP Public Cloud FreeIPA 업그레이드 실패 — CloudResource Duplicate key
¶
CDP 재설치 시 alternatives·고아 UID 잔재 정리와 파슬 배포 문제
¶
CDW Hue 파일 브라우저 HDFS 오류 — HttpFS proxyuser 설정
¶
CM 경고 "host NTP service is not synchronized" — chrony 점검과 내부 NTP 구성
¶
CM 설치 실패 — JAVA_HOME·PATH 불일치와 로그 디렉터리 권한
¶
CM 재설치 후 에이전트 하트비트 오류(cm_guid)와 ECS 환경 생성 DNS 실패
¶
CML 워크스페이스 TLS 인증서 발급과 세션 기동 실패 해결
¶
CML 워크스페이스 업그레이드 실패 — 외부 NFS PVC 리사이즈와 Longhorn 엔진 이미지
¶
Cloudera AI Agent Studio — Kerberos 모듈 누락과 Tool 파라미터 중복 호출
¶
Cloudera AI Inference 가 GPU 를 못 잡을 때 — ECS taint 와 MIG 미지원
¶
Cloudera AI 런타임 이미지와 애드온 문제 해결
¶
Cloudera AI 모델 배포 실패 — 이미지 pull 401 과 레지스트리 인증
¶
Cloudera ECS 1.5.5 istiod 설치 실패 — 레지스트리 인증서와 External Registry Base path
¶
Cloudera Management Service 역할 간 통신 단절과 알림 미동작
¶
Cloudera Manager 7.13.2 업그레이드 %prein 실패 — JDK 17 미설치
¶
Cloudera Manager 다운그레이드 후 DB 스키마 불일치 복구
¶
ECS GPU 노드 NVIDIA 드라이버 업그레이드 — CUDA Error 803
¶
ECS fluentd-aggregator 디스크 증가 원인과 DWX-21391 fluentd 설정 수정
¶
ECS ingress-nginx 파드 진단 — 이미지 pull 실패 확인과 파드별 설정 동기화 검증
¶
ECS 노드 초기화 — Longhorn 마운트 정리와 만료된 레지스트리 인증서
¶
ECS 업그레이드·재기동 시 Vault 파드 기동 실패와 unseal 시점
¶
ECS 장애 진단 — 스케줄러·레지스트리·MTU·Longhorn CSI
¶
ECS 폐쇄망 업그레이드 시 이미지 미러 누락으로 인한 ImagePullBackOff
¶
HDFS 메타데이터 업그레이드를 중단했을 때의 교착 복구
¶
Hue AD/LDAP 연동 실패 — data 52e 와 bind_dn 형식
¶
Hue gunicorn 워커 설정과 504 오류
¶
Install YARN MapReduce Framework JARs 실패 (OPSAPS-67607)
¶
Kerberos 적용 후 Hadoop Web UI 접속 — 브라우저 SPNEGO 설정
¶
Ozone DataNode 기동 실패 — /tmp noexec
¶
Ranger 그룹 정책이 적용되지 않는 문제 — SSSD AD 조인 상태 차이
¶
cmlutils 마이그레이션 오류와 해결
¶
ACID 테이블 major compaction 후에도 일부 ORC 파일의 acid key index가 invalid로 남아 쿼리가 ArrayIndexOutOfBoundsException으로 실패하는 증상
¶
AD 비밀번호 변경 후 CML 세션이 TGT waiting 또는 인증 실패로 생성되지 않는 증상
¶
AI 추론 엔진은 종료됐지만 Pod가 Running으로 남아 모든 요청이 실패하는 증상
¶
ALTER TABLE ADD PARTITION이 HMS의 hive proxyuser 설정 없음으로 간헐 실패하는 증상
¶
Agent Studio Artifact 다운로드에서 한글이 잘리거나 파일명·확장자가 사라지는 증상
¶
Airflow task가 끝났는데 Pod가 Running으로 남아 CPU 요청량을 점유하는 증상
¶
Atlas entity는 REST로 조회되지만 UI 검색에는 나타나지 않는 증상
¶
Atlas ignore pattern 추가 후 Referenced entity is not found와 Kafka hook lag가 쌓이는 증상
¶
Azure PostgreSQL 인증 실패로 Data Lake IDBroker Repair가 중단되는 증상
¶
Base 7.3.2 업그레이드 계획에서 CAI Spark pushdown 호환성이 맞지 않는 문제
¶
CAI FastAPI Application이 중단되고 수집한 로그 폴더도 비어 있는 증상
¶
CAI Job의 Resource Profile을 변경해도 Settings에 다른 값이 표시되는 증상
¶
CAI NIM 모델 반입에 필요한 NGC 자격증명이 없어 다운로드를 진행하지 못하는 문제
¶
CAI Workbench 팀 생성과 멤버 추가를 API로 수행하는 방법
¶
CAI Workbench에 새 사용자가 보이지 않아 Sync Users를 API로 실행하는 방법
¶
CAI 모델 배포가 ImagePullBackOff와 401 Unauthorized로 멈추는 증상
¶
CAI 모델 이미지를 내부 Registry에 push·pull할 때 TLS 오류 뒤 401이 발생하는 증상
¶
CAI 화면에서 GPU 사용률·VRAM·온도를 확인할 대시보드가 없는 문제
¶
CAII 그룹 권한으로는 403이지만 사용자에게 직접 역할을 주면 접근되는 증상
¶
CAII·RAG 애플리케이션이 약 한 시간 뒤 HTTP 401을 반환하는 증상
¶
CDE Airflow Oracle 연결이 DPI-1047 또는 libnnz 라이브러리 누락으로 실패하는 증상
¶
CDE Airflow Python 환경 생성이 graphviz/cgraph.h 없음으로 실패하는 증상
¶
CDE Airflow의 짧은 수동 DAG도 시작까지 오래 기다리는 증상
¶
CDE·CAI 모니터링의 과거 지표가 사라져 장기 보관이 필요한 문제
¶
CDP Base에서 Iceberg manifest 파일의 반복 조회를 줄이도록 캐시를 설정하는 방법
¶
CDP Public Cloud 계정에 추가됐지만 Console로 이동하지 못하거나 권한이 없는 문제
¶
CDP 업그레이드 후 Ranger Audit 화면에서 Solr 조회 오류(ZkStateReader getLeaderRetry 실패)가 발생하는 증상
¶
CDSW Workbench가 지정한 Conda 환경 대신 기존 Python 패키지를 사용하는 증상
¶
CDSW 모델 빌드가 ResolutionTooDeep 뒤 모듈 누락으로 실패하는 증상
¶
CDSW 모델 빌드가 프로젝트의 중첩 .git 디렉터리 때문에 실패하는 증상
¶
CDSW 세션이 pip.conf의 EACCES permission denied로 종료되는 증상
¶
CDSW 워커노드 Docker Block Device 디스크 교체 후 dockerd가 ''expected integer''로 기동 실패하고, 복구 후에는 docker load가 멈추는 증상
¶
CDSW·Cloudera AI 작업이 지정한 vCPU보다 많은 CPU를 사용하는 증상
¶
CDSW에서 IDLE_MAXIMUM_MINUTES를 설정해도 Jupyter Notebook 에디터 세션이 시간제한 없이 계속 자원을 점유하는 증상
¶
CDSW에서 impyla 대량 결과를 DataFrame으로 가져오다가 멈추거나 OOM이 발생하는 증상
¶
CDSW에서 특정 git 원격 저장소만 간헐적으로 clone이 안 되는 증상
¶
CDW 1.5.4에서 Virtual Warehouse(Impala Autoscaler) Web UI 접속 시 오류가 발생하는 증상
¶
CDW Hue Files가 HTTP 401 AuthenticationToken expired로 파일 목록을 보여주지 못하는 증상
¶
CDW Hue의 AI SQL Assistance 기능이 ''Call to AI to fix SQL query failed''로 실패하는 증상
¶
CDW Impala ODBC 연결에서 401 또는 HTTP 응답 오류가 발생하는 증상
¶
CDW coordinator의 Ranger 정책 파일 저장 공간 부족으로 에러가 발생하는 증상
¶
CDW profile shipper가 Azure 권한 오류와 OOM으로 반복 재시작하는 증상
¶
CDW 활성화가 fully qualified domain name cannot be >63 chars로 실패하는 증상
¶
CM 호스트 설치에서 사용할 SSH 개인키 형식과 Auto-TLS 인증서를 구분하는 방법
¶
CML Job이 Pod is ready 이후 더 진행되지 않고 UI에서 Running으로만 표시되며 멈추는 증상
¶
CML 세션이 Exit Code 34로 실패하고 작업 시각이 UTC·로컬 시간으로 섞이는 증상
¶
CM에서 LDAP를 켰지만 HiveServer2가 LDAP 인증을 받아들이지 않는 증상
¶
CM의 HDFS Client heap 변경이 실제 명령에 반영되지 않는 증상
¶
Catalogd에서 Thrift 역직렬화 오류와 함께 native 메모리가 계속 증가하는 증상
¶
Cloudera AI SMTP 테스트가 AggregateError로 실패하지만 Notebook 메일 발송은 되는 증상
¶
Cloudera AI 모델 추론 요청이 약 30초에서 timeout되는 증상
¶
Cloudera AI에서 Hadoop 명령이 GLIBC 버전 오류로 실행되지 않는 증상
¶
Cloudera Partner Portal이 Salesforce single sign-on 오류로 로그인되지 않는 증상
¶
Cloudera 로그인은 되지만 Support Portal·Partner Academy 접근이나 Case 생성이 거부되는 문제
¶
Data Catalog 업그레이드가 das-event-processor Ready 대기에서 timeout되는 증상
¶
Data Lake DB 업그레이드는 성공으로 표시되지만 PostgreSQL 실제 버전이 그대로인 증상
¶
Data Lake 업그레이드 백업이 S3 PutObject AccessDenied로 실패하는 증상
¶
Data Services 업그레이드 후 사용자 이름에 u_가 붙어 Ranger 권한이 맞지 않는 증상
¶
Data Services 자동 진단 번들이 누적되어 디스크가 가득 차는 증상
¶
DataLake/DataHub의 Public Certificate 자동 갱신이 ipa_packages_install 오류로 실패하는 증상
¶
ECS kubelet 디렉터리 용량이 부족해 별도 파일시스템으로 옮겨야 하는 문제
¶
Flink의 S3 호환 저장소 쓰기가 InvalidAccessKeyId 또는 SignatureDoesNotMatch로 실패하는 증상
¶
FreeIPA 업그레이드가 Duplicate key CloudResource로 즉시 실패하고 OS 표시도 실제와 다른 증상
¶
GC 일시정지로 NameNode가 ZKFC에 응답하지 않게 되고, 복귀 후 저널 에포크가 뒤처져 자체 종료되는 증상
¶
GPU가 할당되고 nvidia-smi도 되지만 CAII가 No CUDA GPUs are available로 종료되는 증상
¶
H100의 GDN 모델이 FlashInfer prefill warmup 단계에서 기동 실패하는 증상
¶
HBase Failed log close로 RegionServer가 abort되고 WAL 복구가 오래 멈추는 증상
¶
HBase RegionTooBusyException과 memstore flush 지연으로 쓰기가 막히는 증상
¶
HBase archive 디렉터리 사용량이 지속적으로 증가하는 증상
¶
HBase split이 Split row is equal to startkey로 실패하는 증상
¶
HDFS Balancer가 한 번 실행한 뒤 MetricsException으로 종료되는 증상
¶
HDFS missing block 또는 corrupt replica 경고가 발생하는 증상
¶
HDFS under-replicated block 또는 replicated to 0 nodes 오류가 발생하는 증상
¶
HDFS 또는 YARN 프로세스에 Too many open files가 발생하는 증상
¶
HDFS가 시작 후 Safe Mode에서 오래 벗어나지 못하는 증상
¶
HDP 3.1 업그레이드 후 hbase thriftserver의 batch increment 요청에서 간헐적으로 ArrayIndexOutOfBoundsException이 발생하는 증상
¶
Hive ACID compaction 뒤에도 delta 디렉터리가 계속 남는 증상
¶
Hive DISTINCT 조회에서 ORDER BY 1과 컬럼명 정렬 결과가 다른 증상
¶
Hive Metastore 힙 급증과 장애 뒤 Impala metadata 반영이 지연되는 증상
¶
Hive Metastore의 discover.partitions 조회가 DB CPU를 반복적으로 높이는 증상
¶
Hive MultiDelimitSerDe 클래스를 찾지 못해 테이블 생성이 실패하는 증상
¶
Hive Tez task가 Java Heap 또는 container memory 초과로 종료되는 증상
¶
Hive VARCHAR 길이보다 긴 값을 넣어도 오류 없이 잘리는 증상
¶
Hive bucket 파일 조회가 날짜 문자열의 NumberFormatException으로 실패하는 증상
¶
Hive privilege synchronizer의 반복 DB 작업으로 HS2가 느려지는 증상
¶
Hive scratch 정리 주기를 설정해도 예상과 다른 시점에 파일이 삭제되거나 남는 증상
¶
Hive 빈 파티션을 조회할 때 HDFS FileNotFoundException이 발생하는 증상
¶
Hive 업그레이드 후 특정 집계 쿼리가 수십 분 지연되는 증상
¶
Hive 테이블 데이터를 Trash에서 돌려놓아도 테이블이 조회되지 않는 증상
¶
Hive 트랜잭션 잠금이 남아 후속 쿼리가 계속 대기하는 증상
¶
HiveServer2 세션은 없는데 CM open_operations 값이 계속 남는 증상
¶
HiveServer2의 S3 작업이 Timeout waiting for connection from pool로 멈추는 증상
¶
Hue CSV 가져오기가 테이블 중복 오류와 scratch 파일 이동으로 실패하는 증상
¶
Hue Impala 에디터에서 전역 ''INVALIDATE METADATA;''를 실행하면 오류가 발생하는 증상
¶
Hue Workflow 편집기에서 ''Send completion email to'' 체크 후 제출하면 Workflow submission failed 에러가 나는 증상 (Public Cloud)
¶
Hue 로그인 ID의 대소문자가 바뀌어 Ranger 권한이 적용되지 않는 증상
¶
Hue 테이블 목록이 5000개에서 잘리고 한도 변경도 적용되지 않는 증상
¶
Hue가 Oracle RAC 한 노드 중단 후 다른 노드로 연결하지 못하는 증상
¶
Hue에서 Impala DB의 테이블 목록이 보이지 않고 외부 접속도 timeout되는 증상 (Azure AKS 기반 CDW)
¶
Hue에서 View의 Sample 탭이 Fetch failed 또는 유효한 handle 없음으로 실패하는 증상
¶
HuggingFace 모델은 추론되지만 CAII Metrics 화면에 지표가 나타나지 않는 증상
¶
IPA client 재설치 후 DataNode·NodeManager가 CLIENT_NOT_FOUND로 기동 실패하는 증상
¶
Iceberg 테이블에서 ZSTD를 지정했지만 새 Parquet 파일이 다른 압축으로 기록되는 증상
¶
Impala DOUBLE 소수가 지수 표기로 표시되는 증상
¶
Impala NTILE 결과가 같은 쿼리에서도 매번 달라지는 증상
¶
Impala SELECT 별표 조회에서 ARRAY 컬럼이 빠지는 증상
¶
Impala TransmitData RPC가 Transport endpoint is not connected로 실패하는 증상
¶
Impala UNNEST 결과를 window ORDER BY에 쓰면 NullPointerException이 발생하는 증상
¶
Impala VIEW 생성 안의 WITH 별칭을 테이블로 찾지 못하는 증상
¶
Impala audit 컨테이너에서만 kinit Cryptosystem internal error가 발생하는 증상
¶
Impala catalogd가 JVM pause 뒤 종료되고 standby로 전환되는 증상
¶
Impala 대용량 테이블 metadata가 MaxMessageSize reached로 로딩되지 않는 증상
¶
Impala 실행 계획의 cardinality가 틀리거나 JOIN 계획이 비효율적인 증상
¶
Impala 업그레이드 후 나눗셈 결과의 소수점 자릿수가 달라지는 증상
¶
Impala 쿼리가 Waiting on Client 또는 FINISHED 상태로 오래 남는 증상
¶
Impala 쿼리가 server certificate has no signature digest 오류로 실패하는 증상
¶
Impala가 다중 문자 구분자 테이블을 Invalid delimiter 오류로 읽지 못하는 증상
¶
Impala에서 UNNEST와 UNION을 함께 사용하면 IllegalArgumentException이 발생하는 증상
¶
Impala의 S3 INSERT가 s3ablock용 local directory를 찾지 못해 실패하는 증상
¶
Java 11 환경에서 Impala Coordinator가 특정 워크로드 패턴에서 반복적으로 Hang되는 증상
¶
KServe(Cloudera AI)의 web-hook 인증서가 만료돼 있는 증상
¶
KServe·cert-manager webhook 인증서 만료로 리소스 생성이 실패하는 증상
¶
Kafka Connect는 데이터를 쓰는데 SMM과 REST에서 No status found 404가 발생하는 증상
¶
Kafka controller 로그에 NotLeaderForPartitionException이 반복되며 broker가 장애를 일으키는 증상
¶
Kafka 파티션이 OfflinePartition에 남고 leader 선출에 실패하는 증상
¶
Kerberos 활성화 후 서비스 시작이나 Ranger 권한 갱신이 일부 노드에서 실패하는 증상
¶
Knox HA에서 인증이 401·403으로 실패하고 JWT 발급이 되지 않는 증상
¶
Knox는 정상인데 CM이 8443 Gateway Health 포트 충돌을 경고하는 증상
¶
Kudu Master가 range-aware replica placement 오류로 시작하지 못하는 증상
¶
Kudu RowProjector compilation 큐 포화와 Impala scan timeout이 함께 발생하는 증상
¶
Kudu master가 STOPPING 상태에서 멈춰 재시작이 안 되는 증상
¶
Kudu range partition 변경 후 INSERT를 반복하면 Impala가 SIGSEGV로 종료되는 증상
¶
Kudu 재시작이 FS layout already exists 오류로 실패하는 증상
¶
Kudu가 Clock unsynchronized 또는 clock error too high로 종료되는 증상
¶
Kudu가 Soft memory limit exceeded로 쓰기를 거부하는 증상
¶
Kudu가 WAL 또는 데이터 디스크 공간 부족으로 기동되지 않는 증상
¶
Kudu에 넣은 대용량 문자열을 Impala에서 RPC frame 크기 오류로 읽지 못하는 증상
¶
Kudu의 HMS 연동·Master 변경 뒤 DROP·ALTER가 실패하는 증상
¶
LB 뒤 특정 Impala Coordinator에서만 JDBC·BI 연결이 timeout되는 증상
¶
LDAP Test Connection은 성공하지만 실제 로그인에 Unbalanced parenthesis가 발생하는 증상
¶
LDAP 그룹 매핑 적용 후 로컬 서비스 계정의 그룹을 찾지 못하는 증상
¶
LLAP가 InvalidACL 대기 후 SSL 오류·LlapIoImpl 초기화 실패로 시작되지 않는 증상
¶
Livy에서 Spark python lib 디렉터리의 FD가 계속 누적되는 증상
¶
Longhorn의 fluentd-aggregator 볼륨 사용량이 계속 증가하는 증상
¶
MapReduce가 MRAppMaster 또는 CompositeService 클래스를 찾지 못하는 증상
¶
NAT 뒤의 GPU worker가 ECS 내부 노드에 연결되지 않는 증상
¶
NIM 모델 등록은 성공했지만 Endpoint의 런타임 이미지가 내부 Registry에 없어 배포가 실패하는 증상
¶
NameNode 데이터 디렉터리를 제공하던 NFS 서버가 hang되자 HA 페일오버가 두 NameNode를 모두 Active로 만든 증상
¶
Navigator Metadata Server 메모리가 계속 증가하고 삭제된 HDFS 파일이 검색되는 증상
¶
NiFi ExecuteScript에서 Python 3 코드가 Python 2 문법·모듈 오류로 실패하는 증상
¶
NiFi PutKudu가 auto_incrementing_id is not set 오류로 쓰지 못하는 증상
¶
NiFi PutKudu가 unauthorized action으로 쓰기를 거부당하는 증상
¶
NiFi PutKudu만 Master 연결 timeout·Broken pipe로 실패하는 증상
¶
NiFi Registry 로그인 후 설정 아이콘·bucket 권한이 보이지 않는 증상
¶
NiFi TLS 설정 뒤 truststore properties invalid 또는 heartbeat handshake 실패로 기동되지 않는 증상
¶
NiFi UI에 too many outstanding HTTP requests가 발생하는 증상
¶
NiFi 재설치 후 flow 복호화가 Tag mismatch로 실패하는 증상
¶
NiFi는 정상인데 Knox 경유 UI만 Connection refused로 실패하는 증상
¶
NiFi에서 JDBC로 Kudu에 적재할 때 Timestamp 밀리초가 사라지는 증상
¶
NodeManager가 recovery-state의 MANIFEST 파일 누락으로 시작하지 못하는 증상
¶
NodeManager가 unhealthy 상태가 되어 YARN 작업을 받지 않는 증상
¶
Oozie Shell Action의 kinit이 credentials cache permissions incorrect로 간헐 실패하는 증상
¶
Oozie shell action을 병렬로 실행하면 진행 중인 다른 job의 작업 디렉터리까지 삭제되어 FileNotFoundException이 발생하는 증상
¶
Oozie 편집기 저장 후 빈 done-flag가 사라져 입력을 계속 기다리는 증상
¶
Oracle HMS에서 DROP CATALOG와 Canary가 deadlock으로 실패하는 증상
¶
PVC 환경에서 Impala 테이블·파티션 생성 시 Permission denied 또는 cannot impersonate User 오류가 발생하는 증상
¶
Python ODBC 종료·오류 후 GET_CATALOGS 요청이 대량 반복되는 증상
¶
Python 변경 후 impyla SSL 연결이 Could not connect로 실패하는 증상
¶
RAG의 일반 LLM 호출은 되지만 스트리밍 중 SSL 오류가 발생하는 증상
¶
Ranger all-path 정책의 Audit Logging을 꺼도 HDFS 감사 파일이 계속 쌓이는 증상
¶
Ranger 마스킹 적용 후 Impala SELECT 별표의 컬럼 순서나 View 조회가 틀리는 증상
¶
Ranger에서 그룹 권한을 줬지만 Impala가 사용자를 해당 그룹으로 인식하지 못하는 증상
¶
SMM에서 Debezium MySQL connector 검증 시 클래스 초기화 오류가 발생하는 증상
¶
Salt 비밀번호 불일치로 FreeIPA 업그레이드가 실패하거나 진행되지 않는 증상
¶
Spark 압축 설정을 바꿔도 출력 ORC 파일의 codec이 바뀌지 않는 증상
¶
Sqoop Parquet export가 GenericData Fixed 형변환 오류로 실패하는 증상
¶
Sqoop의 as-orcfile과 query 조합이 NullPointerException으로 실패하는 증상
¶
YARN UI가 Too many open files로 실패하고 이후 Sqoop 작업에서 NPE가 발생하는 증상
¶
YARN usercache 생성 또는 HDFS 경로 접근에 Permission denied가 발생하는 증상
¶
enable_range_replica_placement 설정이 켜진 상태에서 Kudu master가 정상적으로 기동되지 않는 증상
¶
etcdserver mvcc database space exceeded로 Kubernetes 쓰기가 막히는 증상
¶
hbase Export로 매일 백업하는 스크립트가 간헐적으로 멈추는(hang) 증상
¶
kudu ksck에서 master 간 consensus matrix가 서로 다르게 나타나는(master consensus conflict) 증상
¶
parquet-tools가 HDFS 파일에 No FileSystem for scheme hdfs를 반환하는 증상
¶
skipTrash 없이 대량 파일을 삭제한 뒤 trash checkpoint 처리 중 NameNode가 응답 불능(장애·페일오버 오작동)에 빠지는 증상
¶
노드 재시작 후 CDW Pod가 초기화에 머물며 image pull secret 경고를 내는 증상
¶
다른 노드에 여유가 있는데 CDE 작업이나 CAI 모델이 Pending에 머무는 증상
¶
동시에 실행한 Hive·Impala DDL이 HMS DB 연결 대기로 길게 지연되는 증상
¶
디스크 사용량은 정상인데 Kubernetes DiskPressure가 유지되는 증상
¶
로그를 삭제해도 df 사용량이 줄지 않고 du와 차이가 큰 증상
¶
보안 클러스터에서 비보안 HDFS를 참조할 때 SIMPLE 인증 전환이 거부되는 증상
¶
복구 후 Kudu RPC TLS 협상과 Ranger 정책 조회가 실패하는 증상
¶
부하 중 HiveServer2 HTTP 신규 연결만 Connection refused로 실패하는 증상
¶
새 Gateway 호스트에 설치할 CM Agent와 기존 클러스터 버전이 맞지 않는 문제
¶
업그레이드 뒤 Ozone OM·SCM의 MLV와 SLV가 달라 not finalized 경고가 남는 증상
¶
외부 파일 변경 후 Impala가 File Not Found 또는 이전 데이터를 조회하는 증상
¶
원본 테이블 컬럼을 바꿔도 Impala VIEW 컬럼이 갱신되지 않는 증상
¶
정전 후 HA NameNode 한 대만 기동되고 다른 한 대가 메타데이터 오류로 실패하는 증상
¶
지원 케이스 생성 알림을 받던 담당자에게 이메일이 더 이상 오지 않는 문제
¶
컨테이너가 runAsNonRoot와 image will run as root 오류로 시작되지 않는 증상
¶
클러스터 재구축·업그레이드 후 SparkSession 생성이나 Executor 기동이 실패하는 증상
¶
특정 Pod가 로그를 폭주시키면 Fluentd가 삭제된 로그 파일의 FD를 계속 붙잡아 워커 노드 /var/log가 가득 차는 증상
¶
폐쇄망 CAI GPU 워커를 추가했지만 GPU를 선택하거나 사용하지 못하는 문제