GPU 할당량이 0이라 EC2 검증이 멈췄습니다
어제(9/2) 만들어 둔 AWS 자원 위에 GPU 인스턴스를 올리려 했는데, 시작이 거부됐습니다. 원인은 권한도 설정 실수도 아니고 계정의 GPU 할당량이 0인 것이었습니다.
You have requested more vCPU capacity than your current vCPU limit of 0 allows for the instance bucket that the specified instance type belongs to.
g4dn.xlarge · 서울 · 온디맨드. 과금은 없습니다 — 인스턴스가 만들어지지 않고 “개시 시작: 실패함”에서 멈췄습니다.
어제 적어 둔 우려가 그대로 나왔습니다
ho 계정은 Service Quotas 화면이 막혀 있어(ListAWSDefaultServiceQuotas 거부) 할당량을 보지도 신청하지도 못합니다. 그래서 어제는 “0일 수 있는데 확인할 방법이 없다”고만 적고 넘어갔습니다.
오늘 확인 방법을 찾았습니다 — 그냥 시작을 눌러 보는 것입니다. 거부되면 에러 메시지가 현재 한도를 숫자로 알려주고, 인스턴스가 안 뜨니 공짜입니다. 권한 없이 할당량을 아는 유일한 수단이라 런북에 적어 두었습니다.
지금 필요한 것 — 할당량 증액 하나
미결 항목 「AWS 계정에서 ho가 IAM·할당량을 못 쓴다」 에 올려 두었습니다. 담당은 정어진 님(배포·AWS 계정)입니다.
- “Running On-Demand G and VT instances” 할당량을 8 이상으로 신청
- 8인 이유: 4면
g4dn.xlarge하나로 묶입니다. 호스트 RAM이 모자라g4dn.2xlarge로 올려야 할 때(미결 9번) 승인을 다시 며칠 기다리게 됩니다 - 승인 소요는 AWS가 정하고 수 시간~며칠입니다
앞서 “이 항목이 EC2 진행을 막지는 않는다”고 적었던 것을 정정합니다. 그건 S3 우회 경로를 두고 한 말이었고 그 부분은 지금도 맞습니다. 그러나 할당량 0은 우회가 없습니다 — GPU 인스턴스를 아예 못 만듭니다.
같은 항목에 있는 IAM 역할 건은 급하지 않습니다. 역할이 없어도 S3를 건너뛰고 검증할 수 있습니다(모델은 HuggingFace에서 직접, 영상·리포트는 scp). 할당량부터 부탁드립니다.
기다리는 동안 잡아 둔 것
인스턴스가 뜨면 시간당 과금이 시작되므로, 올라가서 터질 것을 미리 봤습니다.
agent테스트 142개 전부 통과 — 올려도 되는 상태입니다- 🔴 런북의
git clone주소가 존재하지 않는 저장소를 가리키고 있었습니다.jsangho/super-sub.cloud는 없는 저장소이고 실제는pmhllll12/super-sub.cloud입니다. EC2 4장 첫 명령이라 과금되는 인스턴스 위에서 404로 멈췄을 것입니다. 미결 항목의 링크 세 개도 같은 주소여서 함께 고쳤습니다 - AMI가 바뀌었습니다. 런북은 Ubuntu 22.04라고 적어 두었는데 AWS가 DLAMI 기반을 올려서 빠른 시작 목록에 Ubuntu 26.04만 있습니다. 26.04로 가도 됩니다 —
uv가 자체 Python 3.12를 받아 쓰고 torch도 cu126 휠을 직접 받아 OS 기본 파이썬과 무관합니다. 런북에 “목록의 최신 Ubuntu 판을 고른다”로 고쳐 적었습니다
만들어 둔 것 (그대로 씁니다)
승인이 나면 인스턴스 시작부터 이어갑니다. 아래는 이미 있고 다시 만들 필요가 없습니다.
| 리소스 | ID |
|---|---|
| S3 버킷 | supersub-ai |
| VPC | <VPC ID> |
| 퍼블릭 서브넷 | <서브넷 ID> |
| 보안 그룹 | <보안그룹 ID> (SSH 22 / 내 IP) |
| 키 페어 | supersub-ai (오늘 생성, WSL 사본 권한 400까지) |
전부 무료 자원이라 기다리는 동안 두어도 비용이 없습니다.