aws-graviton5

3 개의 포스트

aws

AWS Graviton5 프로세서 기반 Amazon EC2 C9g 및 C9gd 인스턴스 출시 | Amazon Web Services (새 탭에서 열림)

AWS가 AWS Graviton5 기반의 컴퓨팅 최적화 EC2 C9g 및 로컬 NVMe 스토리지를 갖춘 C9gd 인스턴스를 정식 출시했다. C9g는 이전 C8g보다 vCPU당 최대 25% 높은 성능과 더 빠른 메모리·대형 캐시·향상된 네트워크 성능을 제공하며, C9gd는 여기에 고속 로컬 SSD를 추가한다. 두 인스턴스는 배치 처리, HPC, 동영상 인코딩, 실시간 분석, CPU 기반 ML 추론, 에이전틱 AI 등에 적합하다. ## Graviton5 기반 성능 향상 - C9g는 이전 세대 C8g 대비 vCPU당 최대 25% 높은 성능을 제공한다. - DDR5 8800MT/s 메모리를 사용해 클라우드 프로세서 인스턴스 중 가장 빠른 메모리 성능을 제공한다. - L3 캐시가 5배 늘어나 데이터 대기 시간을 줄이고, 인메모리 분석과 실시간 애플리케이션의 처리량을 높인다. - Graviton4 기반 인스턴스 대비 패킷 처리 성능이 최대 3배 향상됐다. - 평균적으로 이전 세대보다 네트워크 대역폭은 최대 15%, EBS 대역폭은 최대 20% 높다. - 48xlarge는 네트워크 최대 100Gbps, EBS 최대 72Gbps를 지원하며, 이는 이전 세대 대비 최대 2배 수준이다. ## C9g와 C9gd의 용도 차이 - **C9g** - Amazon EBS를 스토리지로 사용하는 배치 작업, 동영상 인코딩, 분산 분석에 적합하다. - 높은 코어 수와 대형 캐시가 필요한 에이전틱 AI의 병렬 실행 환경과 CPU 중심 추론에 유리하다. - 실시간 분석, 게임, 과학 모델링, 광고 서버 등 CPU 집약적 워크로드에 활용할 수 있다. - **C9gd** - C9g의 컴퓨팅 성능에 로컬 NVMe SSD를 결합한 유형이다. - HPC 시뮬레이션의 임시 작업 공간, ML 추론 캐시, 광고 서버의 로컬 버퍼 등에 적합하다. - 로컬 스토리지 성능은 이전 세대 대비 최대 30% 향상됐다. ## 세부 네트워크·스토리지 기능 - 중간형부터 48xlarge까지 11개 크기와 베어메탈 옵션을 제공한다. - **Instance Bandwidth Configuration(IBC)**으로 EBS와 VPC 네트워크 간 대역폭 배분을 최대 25% 조정할 수 있다. - 데이터베이스나 캐시처럼 특정 대역폭 구성이 중요한 워크로드를 세밀하게 최적화할 수 있다. - ENA Express를 지원해 향상된 네트워킹을 제공한다. - 가상 인스턴스에는 최대 128개의 EBS 볼륨을 연결할 수 있다. - NVMe 인스턴스 스토어 사용 시 I/O 크기별 지연 시간 히스토그램과 1초 단위의 고해상도 성능 지표를 CloudWatch 또는 `nvme-cli`에서 추가 비용 없이 확인할 수 있다. ## Nitro Isolation Engine 적용 - C9g와 C9gd는 Nitro Isolation Engine을 탑재한 최초의 컴퓨팅 최적화 EC2 인스턴스다. - 이 기능은 AWS Nitro System의 구성 요소로, Rust로 구현된 Nitro Hypervisor 기반 격리 기능이다. - 가상 머신 간 메모리, CPU 레지스터 상태, I/O 장치 접근을 최소한의 API를 통해 중재해 격리를 강화한다. - 공식 검증 결과와 적용 범위는 AWS 기술 백서에서 확인할 수 있다. ## 제공 방식과 리전 - On-Demand, Spot, Dedicated Instance, Dedicated Host 및 Savings Plans를 지원한다. - 현재 미국 동부 오하이오·버지니아 북부, 미국 서부 오리건, 유럽 프랑크푸르트 리전에서 사용할 수 있다. - AWS Management Console, AWS CLI, AWS SDK로 생성할 수 있으며 추가 리전은 추후 제공될 예정이다. 워크로드가 CPU 처리량과 메모리 접근 속도를 중시한다면 C9g를, 고성능 로컬 임시 스토리지까지 필요하다면 C9gd를 우선 검토하는 것이 좋다. 실제 도입 전에는 애플리케이션을 Graviton5에서 벤치마크하고, IBC를 활용해 네트워크와 EBS 대역폭 구성을 조정하는 것이 권장된다.

aws

AWS 주간 요약: 프리뷰로 공개된 AWS FinOps 에이전트, Bedrock의 Gemma 4, Kiro Pro Max 등 (2026년 6월 15일) | Amazon Web Services (새 탭에서 열림)

이번 주 AWS 소식은 AI 기반 개발 방식의 생산성 향상, 비용 최적화 자동화, 차세대 인프라와 모델 출시를 중심으로 전개됐다. AWS FinOps Agent는 비용 분석과 최적화 작업을 자동화하고, Graviton5 기반 EC2 M9g는 성능과 격리 보안을 강화했다. 또한 Gemma 4와 OpenSearch MCP Apps를 통해 생성형 AI와 에이전트 기반 운영 환경이 확대되고 있다. ## AI 네이티브 개발팀의 운영 방식 - Amazon의 수백 개 엔지니어링 팀 실험 결과, 구조화된 AI 개발 방식을 적용하면 생산성이 크게 향상됐다. - 6명의 엔지니어가 30명 투입 및 12~18개월이 예상되던 Amazon Bedrock 추론 엔진을 76일 만에 재구축했다. - Amazon Stores의 구조화된 파일럿에서는 배포 속도 중앙값이 4.5배 향상됐고, 일부 팀은 10배 이상 개선됐다. - Perfect Order Experience는 기능 출시 주기가 2주에서 반나절로 단축됐으며, WW Grocery는 설계 문서 작성 시간을 5일에서 몇 시간으로 줄였다. - 프런티어 팀을 위한 주요 실천법은 다음과 같다. - 코딩 규칙, 에이전트 지침, 구조화된 저장소 등 에이전트 컨텍스트를 먼저 구축한다. - 초기에는 생산성이 떨어질 수 있지만 새로운 워크플로가 정착될 때까지 지속한다. - 에이전트가 병렬로 처리할 수 있도록 범위가 명확한 작업 백로그를 유지한다. - 코드 생성 전에 명세와 의도를 구체적으로 정의한다. - 테스트를 개발 초기 단계로 앞당겨 에이전트가 스스로 오류를 수정하도록 한다. - 단순한 커밋 수만으로 생산성을 판단해서는 안 되며, 향후 릴리스 관리·운영·보안·EOL 업그레이드에 대한 후속 내용이 예고됐다. ## AWS FinOps Agent 기반 비용 최적화 - AWS FinOps Agent가 프리뷰로 공개됐다. - AWS 비용에 관한 질의에 답하고, 비용 보고서를 생성하며, 최적화 기회를 탐색한다. - Cost Optimization Hub와 Compute Optimizer를 활용해 다음 항목을 추천한다. - 리소스 라이트사이징 - 유휴 리소스 제거 - Savings Plans 도입 - 추천 결과를 바탕으로 Jira 티켓을 자동 생성할 수 있다. - 비용 이상 징후가 발견되면 원인을 자동 조사하고 결과를 Slack 채널에 게시할 수 있다. - 정기적인 FinOps 작업을 일정에 따라 실행할 수 있어 재무팀과 엔지니어링팀의 비용 관리 자동화에 적합하다. ## EC2 M9g·M9gd와 Graviton5 - EC2 M9g와 M9gd 인스턴스가 정식 출시됐다. - AWS Graviton5와 6세대 Nitro System을 기반으로 한다. - Graviton4 대비 최대 성능 향상: - 일반 컴퓨팅: 최대 25% - 웹 애플리케이션: 최대 35% - 머신러닝 추론: 최대 35% - 데이터베이스: 최대 30% - Graviton5는 AWS 프로세서 최초로 PCIe Gen6와 DDR5-8800 메모리를 지원한다. - 이전 세대보다 L3 캐시가 5배 커졌다. - M8g 대비 평균 네트워크 대역폭은 최대 15%, EBS 대역폭은 최대 20% 향상됐다. - Nitro Isolation Engine은 형식 검증을 활용해 가상 머신 간 격리를 수학적으로 증명한다. - M9gd는 최대 11.4TB의 NVMe SSD 로컬 스토리지와 M8gd 대비 30% 높은 IOPS를 제공한다. - Instance Bandwidth Configuration을 사용하면 EBS와 VPC 네트워크 간 대역폭 배분을 최대 25%까지 조정할 수 있다. ## Bedrock 모델 업데이트와 접근 제한 - Google DeepMind의 Gemma 4 제품군이 Amazon Bedrock에 추가됐다. - 제공 모델은 다음과 같다. - Gemma 4 31B: 256K 토큰 컨텍스트를 지원하며 추론·코딩에 적합 - Gemma 4 26B-A4B: MoE 구조로 비용과 지연 시간에 민감한 작업에 적합 - Gemma 4 E2B: 저지연 대화형 사용 사례를 위한 소형 모델 - 세 모델 모두 함수 호출, 구조화된 출력, 추론, 스트리밍 응답을 지원한다. - 텍스트·이미지·비디오·오디오 입력과 35개 이상의 언어를 지원한다. - Claude Fable 5는 비동기 장기 작업, 다이어그램·차트·PDF 비전 처리, 자체 검증 기능을 제공했다. - 다만 6월 12일 Anthropic이 미국 정부 수출통제 지침 준수를 위해 Claude Fable 5와 Claude Mythos 5의 접근 권한 철회를 AWS에 요청했다. - 해당 모델 사용에는 Data Retention API를 통한 데이터 공유 동의가 필요했으며, Mythos 계열은 입력·출력을 30일간 보관해야 했다. ## OpenSearch MCP Apps와 에이전트형 옵저버빌리티 - Amazon OpenSearch Service가 MCP Apps를 지원한다. - Claude Desktop, VS Code 등 호환되는 에이전트형 IDE에서 OpenSearch 기반 운영 데이터를 직접 조사할 수 있다. - 에이전트는 로그, 트레이스, 메트릭, 알림과 Amazon Managed Service for Prometheus 데이터를 활용해 장애를 분석한다. - 각 MCP 도구 호출은 두 가지 결과를 반환한다. - 에이전트 추론을 위한 텍스트 요약 - 대화 화면에 표시되는 인터랙티브 시각화 - 제공되는 분석 기능에는 로그·메트릭·트레이스 조사, 서비스 성능, 토폴로지, 동적 시각화, 에이전트 상태, 클러스터 상태, 계측 점수 등이 포함된다. ## AWS CLI와 자격 증명 관리 - AWS CLI v1이 유지보수 모드에 들어간다. - botocore와 s3transfer가 별도 패키지가 아니라 CLI v1 코드에 직접 포함된다. - 따라서 CLI v1 업그레이드가 독립적으로 설치된 해당 패키지 버전을 갱신하지 않는다. - CLI v1의 신규 릴리스는 치명적 버그와 보안 문제 수정에 한정된다. - AWS는 AWS CLI v2로의 마이그레이션을 권장한다. - AWS Workload Credentials Provider도 공개됐다. - AWS 외부 또는 온프레미스에서 실행되는 애플리케이션이 장기 액세스 키 없이 단기 자격 증명을 발급받을 수 있다. - 이를 통해 워크로드별 최소 권한 원칙과 자격 증명 보안을 강화할 수 있다. ## Kiro Pro Max - Kiro에 Pro Max 요금제가 추가됐다. - 더 높은 사용량 한도, 최신 프런티어 모델 접근 권한, 추가 에이전트 기능을 제공한다. - 지속적으로 AI 개발 기능을 사용하는 전문 개발팀을 주요 대상으로 한다. - 원문은 이 항목에서 일부가 잘려 있어 세부 기능과 가격 정보는 확인할 수 없다. 이번 발표들은 AWS가 단순한 클라우드 인프라 제공을 넘어, 비용 관리·소프트웨어 개발·운영 관측성까지 에이전트가 자동화하는 방향으로 확장하고 있음을 보여준다. 실무에서는 AWS CLI v2 마이그레이션을 우선 검토하고, FinOps Agent와 MCP Apps는 권한·데이터 보존·운영 자동화 범위를 점검한 뒤 제한된 환경에서 도입하는 것이 적절하다.

aws

이제 사용 가능: 새로운 AWS Graviton5 프로세서로 구동되는 Amazon EC2 M9g 및 M9gd 인스턴스 | Amazon Web Services (새 탭에서 열림)

AWS가 자체 설계한 Graviton5 프로세서 기반 EC2 M9g와 M9gd 인스턴스를 정식 출시했다. Graviton4 대비 최대 25% 높은 컴퓨팅 성능, 더 큰 캐시와 높은 메모리·네트워크·스토리지 대역폭을 제공하며, M9gd는 최대 11.4TB의 로컬 NVMe SSD를 추가한다. 특히 에이전트형 AI, 데이터베이스, 웹 애플리케이션처럼 CPU와 I/O를 동시에 많이 사용하는 워크로드의 성능과 에너지 효율 향상을 목표로 한다. ## Graviton5의 성능 및 설계 개선 - Graviton5는 AWS의 다섯 번째 자체 설계 Arm 프로세서다. - 최대 192개의 코어를 제공하며, 이전 세대보다 L3 캐시가 5배 커졌다. - 코어 간 지연 시간은 최대 33% 감소해 병렬 처리와 다수의 동시 작업에 유리하다. - DDR5-8800 메모리와 PCIe Gen6를 지원해 AWS 인스턴스 중 가장 빠른 메모리 성능을 제공한다. - Graviton4 대비 성능 향상 폭은 다음과 같다. - 전체 컴퓨팅 성능: 최대 25% - 웹 애플리케이션: 최대 35% - 머신러닝 추론: 최대 35% - 데이터베이스: 최대 30% - 성능 향상과 함께 에너지 효율도 개선해 비용 및 지속 가능성 목표 달성에 도움을 준다. ## 에이전트형 AI와 CPU 수요 대응 - AI가 단순 질의응답을 넘어 코드 실행, 도구 호출, 결과 평가, 다단계 작업 조율을 수행하면서 CPU 처리량의 중요성이 커지고 있다. - Graviton5는 다음 특성으로 에이전트형 AI에 적합하다. - 높은 코어 수로 다수의 실행 환경을 동시에 처리 - 대형 L3 캐시로 CPU 대기 시간 감소 - 높은 메모리 대역폭으로 데이터 처리량 향상 - 가속기가 CPU 작업을 기다리는 시간을 단축 - Meta는 실시간 추론, 코드 생성, 다단계 작업 조율을 위해 수천만 개 규모의 Graviton 코어를 배포할 계획이라고 밝혔다. - Honeycomb은 6개월간의 실제 운영 A/B 테스트에서 Graviton4 대비 코어당 처리량이 36% 향상됐다고 보고했다. ## M9g와 M9gd의 차이 ### M9g: 범용 컴퓨팅 중심 - vCPU 1개당 4GiB 메모리를 제공한다. - 다음과 같은 범용 워크로드에 적합하다. - 애플리케이션 서버와 마이크로서비스 - 중간 규모 데이터 저장소 - 게임 서버와 캐시 클러스터 - 컨테이너 애플리케이션 - 대규모 Java 애플리케이션 - 코드 저장소와 웹 애플리케이션 - 에이전트형 AI ### M9gd: 로컬 NVMe 스토리지 추가 - 최대 11.4TB의 로컬 NVMe SSD를 제공한다. - Graviton4 기반 M8gd보다 IOPS 및 스토리지 성능이 30% 향상됐다. - 낮은 지연 시간의 임시 또는 로컬 스토리지가 필요한 작업에 적합하다. - 캐시와 스크래치 파일 - 데이터 로깅 - 미디어 처리 - 배치 및 로그 처리 - 키-값 데이터 저장소 - 게임 서버와 마이크로서비스 - 컴퓨팅, 메모리, 네트워크, EBS 대역폭 사양은 동일한 크기의 M9g와 같다. ## 네트워크와 스토리지 대역폭 개선 - M9g와 M9gd는 이전 세대 대비 평균적으로 다음 대역폭을 제공한다. - 네트워크 대역폭: 최대 15% 증가 - EBS 대역폭: 최대 20% 증가 - 가장 큰 인스턴스 크기: 네트워크 대역폭 최대 2배 - Instance Bandwidth Configuration(IBC)을 지원한다. - EBS와 VPC 네트워크 사이의 대역폭 할당을 최대 25% 조정할 수 있다. - 데이터베이스 읽기·쓰기, 쿼리 처리, 로깅처럼 특정 I/O 비중이 큰 워크로드에 유용하다. - 컴퓨팅 성능 증가에 맞춰 데이터 이동과 저장장치 처리량도 함께 확장한 것이 특징이다. ## Nitro Isolation Engine을 통한 보안 강화 - M9g와 M9gd는 6세대 AWS Nitro System을 기반으로 한다. - 새롭게 도입된 Nitro Isolation Engine은 가상 머신 간 격리를 담당한다. - 메모리, CPU 레지스터 상태, I/O 장치 접근을 최소한의 API를 통해 제어한다. - 정형 검증(formal verification)을 사용해 특정 테스트 사례가 아니라 수학적으로 격리 동작을 검증한다. - AWS는 이를 통해 Nitro를 공식적으로 검증된 클라우드 하이퍼바이저로 발전시키고, 가상 머신 간 보안 격리에 대한 신뢰성을 높였다고 설명한다. ## 실제 고객 성과 - ClickHouse: 코드 변경 없이 M8g 대비 성능 36% 향상 - Honeycomb: Graviton4 대비 코어당 처리량 36% 향상 - HubSpot: MySQL 쿼리 수행 시간이 최대 60% 감소 - 이러한 사례는 데이터베이스, 분석, 관측성 등 다양한 운영 환경에서의 효과를 보여준다. ## 출시 지역과 구매 방식 - 현재 제공 지역: - 미국 동부 버지니아 - 미국 동부 오하이오 - 미국 서부 오리건 - 유럽 프랑크푸르트 - 구매 방식: - Savings Plans - On-Demand - Spot Instances - Dedicated Instances - Dedicated Hosts 기존 Arm 호환 애플리케이션이라면 M9g부터 성능을 검증하고, 로컬 SSD가 필요하면 M9gd를 선택하는 것이 적절하다. x86 기반 Java 애플리케이션은 AWS Transform을 활용해 호환성 분석, 재컴파일, 의존성 수정, 검증 과정을 자동화할 수 있으며, 도입 전에는 Graviton Savings Dashboard로 비용 절감 효과를 비교하는 것이 좋다.