> ## Documentation Index
> Fetch the complete documentation index at: https://docs.cloud.vessl.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 리소스 제한

> VESSL Cloud가 적용하는 리소스 제한, 제한을 초과하면 일어나는 일, 그리고 어떤 데이터가 보존되는지 알아보세요.

VESSL Cloud는 Workspace를 만들거나 배치 잡을 제출할 때 선택한 리소스 스펙을 기준으로 리소스 제한을 적용해요. 이 문서에서는 어떤 제한이 적용되는지, 워크로드가 제한을 초과하면 플랫폼이 어떻게 동작하는지 살펴봐요.

## 어떤 제한이 적용되나요

| 리소스               | 제한이 생기는 곳             |
| ----------------- | --------------------- |
| CPU               | 리소스 스펙(예: 8 vCPU)     |
| Memory (RAM)      | 리소스 스펙(예: 64 GiB)     |
| GPU memory (VRAM) | GPU 모델(예: H100 80 GB) |
| Temporary storage | 컨테이너 생성 시 할당된 용량      |

<Info>
  리소스 스펙은 Workspace나 Job을 만들 때 선택해요. 어떤 스펙을 쓸 수 있는지는 [워크스페이스 만들기](/ko/member/workspace/create) 또는 [작업 만들기](/ko/member/job/create)에서 확인해 보세요.
</Info>

## 제한을 초과하면 어떻게 되나요

| 초과된 제한            | 결과                                                                   |
| ----------------- | -------------------------------------------------------------------- |
| Memory            | 컨테이너가 종료돼요. `OOMKilled`(Out of Memory Killed, 메모리 부족 강제 종료) 상태로 표시돼요 |
| Temporary storage | 컨테이너가 노드에서 제거돼요                                                      |
| CPU               | 워크로드 속도가 느려지지만 계속 실행돼요                                               |
| GPU memory (VRAM) | 프로세스가 CUDA OOM(Out of Memory) 에러를 받아요. 그 다음 동작은 애플리케이션 코드에 따라 달라요    |

## 워크로드는 어떻게 복구되나요

Memory 또는 Temporary storage 제한 초과로 컨테이너가 종료되면, 워크로드 종류에 따라 복구 방식이 달라요.

| 워크로드      | 복구 동작                                                                                          |
| --------- | ---------------------------------------------------------------------------------------------- |
| Workspace | 정상 노드에서 컨테이너가 자동으로 다시 시작되고, Cluster storage와 Object storage 볼륨도 다시 연결돼요. 임시 데이터와 메모리 상태는 사라져요. |
| Job       | Job이 `failed` 상태가 돼요. 자동 재시도는 없으니, 다시 실행하려면 새 배치 잡을 제출해 주세요.                                   |

## 어떤 데이터가 남나요

| 데이터 위치             | 제한 초과 후 |
| ------------------ | ------- |
| 컨테이너 메모리 상태        | 손실      |
| Temporary storage  | 손실      |
| Cluster storage 볼륨 | 보존      |
| Object storage 볼륨  | 보존      |

<Note>
  Cluster storage와 Object storage 볼륨의 데이터는 리소스 제한을 초과해도 영향을 받지 않아요. 잃어버리면 안 되는 데이터는 이 두 곳에 저장해 주세요.
</Note>

## 사용량 확인하기

실시간 사용량과 과거 사용 패턴은 아래에서 확인할 수 있어요:

* [워크스페이스 메트릭 모니터링하기](/ko/member/workspace/metrics): GPU, VRAM, CPU, 메모리, 네트워크 사용량
* [작업 메트릭 모니터링하기](/ko/member/job/metrics): 배치 잡의 동일한 메트릭
* [워크스페이스 로그](/ko/member/workspace/logs): `OOMKilled`와 축출(eviction) 이벤트 확인
* [작업 로그](/ko/member/job/logs): 실패 원인 확인

## 관련 문서

* [크레딧 소진 정책](/ko/admin/billing/credit-exhaustion-policy): 크레딧 잔액이 0이 됐을 때 일어나는 일
* [Container Compute 서비스 약관](/ko/legal/container-compute): 리소스 제한에 대한 계약 조항
