> For the complete documentation index, see [llms.txt](https://docs.roboflow.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.roboflow.com/deployment/ko/production-checklist.md).

# 프로덕션 준비 체크리스트

Roboflow 배포를 위한 운영 준비 상태 - HTTP 오류 처리 및 재시도, 시간 초과와 콜드 스타트, 속도 제한, Dedicated Deployment 복제본 크기.

일단 [배포 옵션을 선택했다면](/deployment/ko/choosing-a-deployment.md)이 페이지를 사용해 프로덕션 트래픽을 처리하기 전에 통합을 강화하세요. 여기에는 오류 처리 및 재시도, 타임아웃 및 콜드 스타트, 레이트 제한, 그리고 다음에 대한 복제본 크기 조정이 포함됩니다: [전용 배포](/deployment/ko/roboflow-cloud/dedicated-deployments.md).

## 자체 호스팅 서버 액세스

자체 호스팅 배포의 경우, 확인하세요 [네트워크 액세스, 인증, 가시성](/deployment/ko/self-hosted/inference-server/configuration/security.md) 원격 클라이언트를 허용하기 전에. 검토하세요 [보안 구성 마이그레이션](/deployment/ko/self-hosted/inference-server/configuration/security-migration.md) CLI 또는 서버 이미지 업그레이드 시.

## HTTP 오류 및 재시도

Roboflow의 추론 및 관리 API는 표준 HTTP 상태 코드를 사용합니다. 도구 간 전체 표(REST 상태 코드, SDK 예외, CLI 종료 코드)는 [오류 및 상태 코드](https://docs.roboflow.com/reference/errors-and-status-codes)에 있습니다. 프로덕션에서의 핵심 규칙은 실제로 재시도할 수 있는 것만 재시도하는 것입니다:

| 상태            | 재시도? | 안내                                                                                                  |
| ------------- | ---- | --------------------------------------------------------------------------------------------------- |
| `200` / `204` | -    | 성공.                                                                                                 |
| `400`         | 아니요  | 형식이 잘못된 요청 - 페이로드를 수정하세요. 재시도하면 동일한 잘못된 요청이 전송됩니다.                                                  |
| `401` / `403` | 아니요  | 인증 또는 액세스 실패. 재시도해도 키가 유효해지지 않습니다. API 키와 해당 스코프를 확인하세요.                                            |
| `402` / `423` | 아니요  | 요금제 제한, 할당량 초과 또는 결제 일시 중지. 다음에서 해결하세요 [결제](https://roboflow.com/pricing) 측면에서 처리하고, 루프로 재시도하지 마세요. |
| `404`         | 아니요  | 리소스가 존재하지 않거나 키에 표시되지 않습니다.                                                                         |
| `429`         | 예    | 레이트 제한이 걸렸습니다. 대기한 후 지수 백오프로 재시도하세요( [레이트 제한](#rate-limits)).                                       |
| `5xx`         | 예    | 일시적인 서버 오류. 백오프로 안전하게 재시도할 수 있습니다.                                                                  |

**백오프 패턴.** 다음의 경우 `429` 및 `5xx`지수 백오프와 지터를 사용해 재시도하세요(예: 무작위 오프셋을 둔 1초, 2초, 4초, 8초). 시도 횟수에는 상한을 두세요. 자동으로 재시도하지 마세요 - 대신 애플리케이션에 그대로 노출하세요. `401`/`403`/`404`/`400` 자동으로 재시도하지 마세요 - 대신 애플리케이션에 그대로 노출하세요.

다음을 호출할 때 [전용 배포](/deployment/ko/roboflow-cloud/dedicated-deployments.md#http-api) 관리 서비스(`https://roboflow.cloud`), 응답 코드를 명시적으로 확인하세요: a `200` 는 JSON 본문을 반환하고, 그 외의 코드는 문자열 오류 메시지를 반환합니다.

## 타임아웃과 콜드 스타트

해당 [서버리스 클라우드 API](/deployment/ko/roboflow-cloud/serverless-api.md) 는 모델을 필요할 때 로드합니다. 서버에 이미 상주하지 않는 모델에 대한 첫 요청("웜업")은 몇 초가 걸릴 수 있으며, 유휴 상태였던 모델(예: 추론 사이에 약 10분)이 언로드되어 다음 호출에서 다시 로드해야 할 수도 있습니다.

* **넉넉한 클라이언트 타임아웃을 설정하세요.** 콜드 스타트에서 걸릴 만큼 촉박한 클라이언트 타임아웃은 그렇지 않았다면 성공했을 요청도 실패시킵니다. 첫 요청과 유휴 기간 이후에는 웜업을 위한 여유를 두세요.
* **모델을 예열하세요.** 예측 가능한 지연 시간이 중요하다면, 지연 시간에 민감한 트래픽보다 먼저 웜업 요청을 보내 모델이 이미 캐시되도록 하세요.
* **응답 헤더를 확인하세요.** 서버리스 응답에는 `x-model-cold-start` (이번 요청이 로드 비용을 부담했는지 여부)와 `x-processing-time`가 포함됩니다. 이를 사용해 콜드 스타트 빈도와 지연 시간을 모니터링하세요. 청구는 둘 중 어느 것에도 영향을 받지 않습니다: [모델 가격](/deployment/ko/roboflow-cloud/serverless-api/model-pricing.md) 에서 이미지당 요금을 확인하세요.
* **업로드를 제한 이하로 유지하세요.** Serverless Cloud API는 최대 **20MB**까지의 파일 업로드를 허용합니다. 더 큰 이미지는 거부됩니다. 전송 전에 이미지를 축소하세요(파이썬 SDK는 이를 자동으로 수행합니다). 어차피 이미지는 모델 입력 크기에 맞게 조정되므로, 일반적으로 정확도에는 큰 영향을 주지 않습니다. Batch Processing도 동일한 20MB 이미지당 제한을 적용합니다.

지속적인 저지연을 콜드 스타트 없이 유지하려면 [전용 배포](/deployment/ko/roboflow-cloud/dedicated-deployments.md) 또는 [자체 호스팅 추론](/deployment/ko/self-hosted/self-hosted.md) 을 공유 서버리스 엔드포인트 대신 사용하세요.

## 레이트 제한

* **서버리스 클라우드 API.** 레이트 제한에 걸리면 `429`, 속도를 늦추고 지수 백오프로 재시도하세요. 제한에 계속 걸리거나 더 높은 처리량이 필요하면, 기업 지원 담당자나 [Roboflow 포럼](https://discuss.roboflow.com)에 문의하거나 [전용 배포](/deployment/ko/roboflow-cloud/dedicated-deployments.md).
* **배포 관리자 API.** 엣지 디바이스 관리 엔드포인트는 각 엔드포인트별 명시적 제한을 적용하고, 초과 시 `429` 을 반환합니다. 예를 들어, 디바이스 로그는 **IP당 분당 5개 요청** 및 **전역적으로 분당 50개**, 그리고 텔레메트리 읽기는 **디바이스당 분당 60개 요청** 을 적용하며, 10초에 10개 요청 버스트를 허용합니다. 통합에 폴링을 넣기 전에 정확한 제한과 오류 형태는 [배포 관리자 API](/deployment/ko/self-hosted/enterprise/deployment-manager.md#errors) 를 참조하세요.

문서화된 숫자가 경로에 없다면, 고정된 예산이 있다고 가정하지 말고 `429` 을 신호로 삼아 대기 시간을 늘리세요. 그리고 [지원팀에 문의하세요](https://roboflow.com/sales) 더 높은 제한이 필요하다면.

## 전용 배포 복제본 크기 조정

다음을 생성할 때 [전용 배포](/deployment/ko/roboflow-cloud/dedicated-deployments.md#http-api), 설정할 수 있습니다 `min_replicas` 및 `max_replicas` (둘 다 기본값은 `1`):

* **`min_replicas`** 는 계속 실행되는 복제본 수입니다. 최소값을 높이면 항상 켜져 있는 용량을 대가로 버스트성 부하에서 콜드 스타트 지연이 줄어듭니다.
* **`max_replicas`** 는 부하가 높을 때 배포가 얼마나 확장되는지 상한을 정합니다. 더 높은 피크 처리량이 필요하면 값을 높이세요.

안정적인 트래픽의 경우, `min_replicas` 및 `max_replicas` 의 `1` 가 가장 간단한 시작점입니다. 단일 복제본이 피크 부하를 따라가지 못하면 `max_replicas` 를 높이고, 한동안 조용했다가 첫 요청이 너무 느리면 `min_replicas` 를 올리세요.

### 자동 일시 중지와의 상호작용

전용 배포 **비활성 상태가 일정 기간 지속되면 자동 일시 중지** - 고정값은 `dev-cpu` 및 `dev-gpu` 유형은 1시간으로 고정되어 있으며, API 키로 요청을 보내면 재개됩니다. 일시 중지된 배포는 복제본을 서빙하지 않으므로, 재개하는 요청은 재개 지연 시간을 부담합니다.

* 다음을 사용하세요 **영구 `prod-cpu` / `prod-gpu`** 유형은 항상 준비되어 있어야 하는 프로덕션 트래픽에 사용하세요.
* 일시적 `dev-cpu` / `dev-gpu` 유형은 테스트와 프로토타이핑용으로 예약하세요 - 몇 시간 후에는 자동으로 삭제됩니다.
* 요청 수 기준 청구가 가동 시간 기준이 아닌 방식으로 필요하거나, 사용자 지정 일시 중지/복제본 정책이 필요하다면, [영업팀에 문의하세요](https://roboflow.com/sales).

## 라이브 전 확인 사항

* 재시도는 모든 외부 호출을 감싸며, 다음만 재시도합니다 `429` 및 `5xx` 백오프로.
* 클라이언트 타임아웃은 서버리스 콜드 스타트를 흡수할 만큼 충분히 넉넉합니다.
* 이미지는 20MB 업로드 제한 이하가 되도록 축소됩니다.
* API 키는 최소한의 [스코프](https://docs.roboflow.com/reference/authentication/authentication/scoped-api-keys) 를 사용하며, 하드코딩하지 않고 비밀값으로 저장됩니다.
* 전용 배포의 경우, `min_replicas` / `max_replicas` 는 로드에 맞게 크기가 조정되며, 항상 켜져 있는 트래픽을 위해 `prod-*` 유형을 선택했습니다.
* 배포를 모니터링하세요 - [모델 모니터링](/deployment/ko/monitoring-and-analytics/model-monitoring.md) 를 참고하고, 오류율 및 지연 시간 회귀를 알림으로 설정하세요.
