모델 계산 시간이 길어 정상 결과를 반환하기 전에 요청이 종료된다.
원본에는 공식 timeout 변경 방법이 안내됐지만 적용 결과는 없다. 계산 시간 초과와 replica 부족으로 인한 429는 다른 분기다.
model-proxy의 MODEL_REQUEST_TIMEOUT_SECONDS를 실제 최대 처리 시간에 맞추고 client·ingress의 제한도 확인한다.
확인 수준: 추가 조사 해법 · 해당 케이스 적용 결과 미확인
적용 조건: <...>와 예시 DB·테이블·경로·수치는 실제 확인값으로 바꾼다. 명령과 메뉴는 참고 문서를 바탕으로 보강한 예시이며 대상 시스템에서 실행하지 않았다. 버전·원인에 따른 분기와 남은 확인 사항은 아래에 명시한다.
model.busy는 빈 replica를 찾지 못한 경우이므로 timeout 연장보다 replica 수·동시성을 확인한다.kubectl get deployment -A | grep model-proxy
kubectl -n '<workspace-namespace>' get deployment model-proxy -o yaml > model-proxy-before.yaml
kubectl -n '<workspace-namespace>' set env deployment/model-proxy MODEL_REQUEST_TIMEOUT_SECONDS=120
kubectl -n '<workspace-namespace>' rollout status deployment/model-proxy
30초보다 긴 통제된 요청과 짧은 요청을 각각 실행해 응답 시각·동시 처리·오류율을 확인한다.