아마존 EC2 G7 공개: 엔비디아 블랙웰로 AI 추론 4.6배, 벡터 검색 10배
클라우드에서 AI 추론과 벡터 검색이 한 번에 빨라진다. 엔비디아와 AWS는 2026년 6월 23일 블랙웰 기반 아마존 EC2 G7 인스턴스를 공개했다. G7은 엔비디아 RTX PRO 4500 블랙웰 서버 에디션 GPU로 이전 세대 G6 대비 AI 추론을 최대 4.6배 높이고, 아마존 오픈서치 서버리스는 엔비디아 cuVS로 벡터 인덱싱을 최대 10배 빠르게 4분의 1 비용으로 처리한다. ASAP은 이 발표를 1차 출처 기준으로 정리한다.
스펙부터: G7 한 장에 무엇이 담겼나
아마존 EC2 G7 인스턴스는 엔비디아 RTX PRO 4500 블랙웰 서버 에디션 GPU로 이전 세대 G6 대비 AI 추론을 최대 4.6배, 그래픽을 최대 2.1배 높이다. 한 인스턴스에 GPU 최대 8장, GPU 메모리 총 256GB, 700Gbps EFA 네트워킹, 7.6TB NVMe SSD를 담다. AWS 딥러닝 AMI와 컨테이너, EMR, EKS, ECS에서 바로 쓰고 세이지메이커 AI 지원도 예정이다.
4.6배와 2.1배를 어떻게 읽어야 하나
두 배수는 서로 다른 성격의 수치이다. 4.6배는 AI 추론, 2.1배는 그래픽 워크로드의 개선폭이고 둘 다 이전 세대 G6를 기준으로 한 최대치이다. 최대치는 특정 조건에서 나온 상한선이므로 실제 워크로드에서는 이보다 낮게 나오는 것이 정상이다. 배수 하나만 보고 도입을 결정하기보다, GPU 8장에 256GB라는 총 메모리 용량과 700Gbps 대역폭이 자신의 모델 크기와 배치 규모에 맞는지 먼저 따져보는 편이 실질적이다. RTX PRO 4500이라는 서버 에디션 등급이 데이터센터용 최상위 라인이 아니라는 점도 배수 해석의 배경으로 알아둘 만한다.
오픈서치 서버리스에 cuVS가 기본으로 들어간다
아마존 오픈서치 서버리스는 엔비디아 cuVS로 GPU 가속 벡터 인덱싱을 기본 제공해 CPU 대비 최대 10배 빠르게, 4분의 1 비용으로 처리한다. 엔비디아와 AWS는 10억 규모 벡터 데이터베이스를 한 시간 안에 구축할 수 있다고 밝혔다. RAG와 검색 서비스의 색인 비용과 시간을 동시에 줄이는 변화이다.
국내 실무자에게 왜 중요한가
이 대목이 국내 RAG 도입 팀에 주는 함의는 뚜렷하다. 지금까지 대규모 벡터 색인은 GPU 클러스터를 직접 띄우거나 인덱싱 시간을 며칠 단위로 감내해야 하는 작업이었다. cuVS가 오픈서치 서버리스에 기본으로 들어가면 별도 GPU 인프라 없이 관리형 서비스만으로 색인을 돌릴 수 있고, CPU 대비 4분의 1 비용은 그동안 색인 비용 때문에 미뤄둔 대용량 문서 파이프라인의 손익분기를 앞당긴다. 10배가 CPU 기준 최대치라는 점은 감안해야 하지만, 색인이 빠르다는 것은 곧 문서 갱신 주기를 짧게 가져갈 수 있다는 뜻이라 최신성이 중요한 사내 검색이나 고객 응대 봇에서 특히 체감이 크다.
GB300 학습까지: AWS, 엔비디아 엑셈플러 클라우드 인증
AWS는 엔비디아 GB300 학습 워크로드에 대해 엔비디아 엑셈플러 클라우드(Exemplar Cloud) 인증을 획득했다. 엑셈플러 인증은 엔비디아의 레퍼런스 아키텍처 성능 기준을 충족했다는 의미이다. 추론용 GPU만이 아니라 대규모 학습 기반까지 검증 범위가 넓어졌다.
한 스택으로 묶는다는 그림의 노림수
세 조각을 따로 보면 GPU 인스턴스 하나, 검색 라이브러리 하나, 인증 하나이다. 그러나 엔비디아와 AWS가 이를 같은 날 묶어 발표한 의도는 추론용 G7, 검색용 cuVS, 학습용 GB300을 한 클라우드 스택 안에 나란히 세운다는 데 있다. 사용자가 추론에서 검색, 학습으로 옮겨갈 때 클라우드 밖으로 나가지 않게 만드는 구성이다. 4.6배와 10배는 이전 세대와 CPU 대비 최대치라 실제 워크로드에서는 달라질 수 있고, 그만큼 개별 배수보다 통합 운영이라는 메시지가 이번 발표의 무게 중심이다.
출처: 엔비디아 블로그 'NVIDIA and AWS Collaborate to Bring AI to Production at Scale'(2026년 6월 23일; 아마존 EC2 G7 + RTX PRO 4500 블랙웰 서버 에디션, G6 대비 AI 추론 최대 4.6배·그래픽 최대 2.1배, GPU 최대 8장·256GB·700Gbps EFA·7.6TB NVMe, 아마존 오픈서치 서버리스 + 엔비디아 cuVS 벡터 인덱싱 최대 10배·4분의 1 비용, 10억 규모 벡터 DB 한 시간 내, AWS 엔비디아 GB300 엑셈플러 클라우드 인증) 기반 ASAP 정리.

AI·테크 이슈,
가장 깊게
단순 소식을 넘어, 맥락과 구조까지 파고듭니다
AGI Soon As Possible · asapai.co.kr