AWS

49 개의 포스트

aws4분 읽기큐레이션 요약

AWS 주간 요약: AWS Heroes Summit, Amazon Bedrock의 웹 검색, Dogwood, Kiro Crew 등 (2026년 8월 10일) | Amazon Web Services

AWS는 AI 에이전트의 실시간 정보 활용, 실행 환경 제어, 벡터 검색, 거버넌스와 협업 개발을 강화하는 기능들을 대거 공개했다. Amazon Bedrock의 웹 검색·전용 런타임·DynamoDB 벡터 검색과 AWS Transform의 지속적 현대화가 주요 출시 내용이며, Dogwood와 Agent Plugins를 통해 에이전트의 안전성과 이식성도 확대한다. 또한 AWS Heroes Summit과 Kiro Crew를 통해 개발자 커뮤니티와 멀티에이전트 개발 경험을 강화하고 있다. ## AWS Heroes Summit - 전 세계 AWS Heroes가 초청된 연례 행사로, AI·서버리스·컨테이너 분야 전문가들이 참여했다. - AWS 내부 제품·서비스 팀과 직접 기술 토론, 심층 세션, 피드백 교환을 진행했다. - AWS CEO 맷 가먼의 대담과 James Hamilton의 AMA, 제품 팀별 브레이크아웃 세션 등이 열렸다. - 참가자 간 지식 공유와 협업 기회 확대가 행사의 핵심 성과였다. ## Amazon Bedrock의 웹 검색 - Amazon Bedrock에서 OpenAI 모델이 인터넷을 검색하고 최신 정보를 가져올 수 있게 됐다. - GPT-5.4, GPT-5.5, GPT-5.6 Sol·Terra·Luna 모델이 학습 데이터 이후의 실시간 웹 콘텐츠를 활용할 수 있다. - AI 에이전트가 최신 뉴스나 외부 정보를 바탕으로 답변하도록 구축할 수 있다. - 데이터가 보안이 적용된 AWS 환경에 머물며 외부 데이터 반출 없이 사용할 수 있어 데이터 레지던시 요구사항에 유리하다. ## Bedrock AgentCore 전용 런타임 인스턴스 - AI 에이전트를 전용 런타임 인스턴스에 배포하고 실행할 수 있다. - 에이전트 실행 환경을 더 세밀하게 제어할 수 있으며 성능과 비용을 예측하기 쉽다. - 실행 리소스와 운영 특성이 중요한 프로덕션 에이전트에 적합하다. ## DynamoDB 벡터 검색 - 기존 DynamoDB 데이터와 AI용 벡터 임베딩을 같은 데이터베이스에 저장할 수 있다. - 별도의 벡터 데이터베이스를 운영하지 않고도 의미 기반 검색을 제공한다. - 에이전트 메모리에 저장된 정보에서 관련 내용을 검색해 응답을 보강하는 에이전틱 그라운딩에 활용할 수 있다. - DynamoDB 기반 운영 모델을 유지하면서 예측 가능한 성능으로 벡터 검색을 추가할 수 있다. ## AWS Transform의 지속적 현대화 - 소스 코드 저장소를 대규모로 분석해 기술 부채를 식별하고 수정한다. - 메인프레임과 레거시 워크로드를 일회성 마이그레이션이 아니라 지속적·자동화된 방식으로 현대화한다. - AWS Transform용 Kiro Power와 에이전트 플러그인을 통해 개발 작업을 자동화할 수 있다. ## Lambda 네트워크 대역폭 확대 - Lambda 함수의 네트워크 대역폭이 최대 3,000Mbps로 증가했다. - VPC 외부에서 실행되며 메모리가 2GB 이상인 함수의 네트워크 대역폭이 메모리에 비례해 확장된다. - 2GB 메모리에서는 625Mbps, 10GB 메모리에서는 최대 3,000Mbps를 제공한다. - 대용량 데이터 처리나 Lambda와 다른 AWS 서비스 간 통신이 많은 작업의 성능을 높일 수 있다. ## Dogwood와 시간 기반 에이전트 거버넌스 - AWS는 AI 에이전트용 거버넌스 언어인 Dogwood를 오픈 소스로 공개했다. - Cedar 정책을 지원하고, 에이전트 행동의 시간적 조건을 표현할 수 있다. - AgentCore의 temporal policy는 현재 요청만이 아니라 세션 내 과거 행동 이력에 따라 정책 결정을 내린다. - 반복적인 행동, 특정 순서의 작업, 이전 행동에 따른 권한 제한 등 상태ful한 에이전트 통제가 가능하다. ## Agent Plugins 표준 - Agent Plugins는 AI 에이전트 확장을 위한 오픈 소스·벤더 중립 표준이다. - 하나의 형식으로 확장 기능을 패키징해 Kiro, VS Code, Cursor 등 표준을 구현한 여러 클라이언트에서 사용할 수 있다. - 특정 개발 도구에 종속되지 않는 에이전트 확장 생태계를 구축하는 것이 목적이다. ## Kiro Crew의 멀티에이전트 개발 - Kiro Crew는 작업 상태를 지속적으로 유지하는 협업형 개발 workspace다. - 단일 채팅 세션을 넘어 여러 저장소, 도구, 날짜에 걸친 엔지니어링 작업을 관리한다. - 여러 작업을 병렬로 실행하거나 하위 에이전트에게 작업을 위임할 수 있다. - 하위 에이전트가 작업 결과를 보고하므로 개발자가 자리를 비운 동안에도 작업이 진행된다. 이번 발표의 방향은 AI 에이전트를 단순한 대화형 도구에서 실시간 검색, 장기 실행, 상태 기반 권한 관리, 협업 자동화가 가능한 운영 시스템으로 발전시키는 데 있다. 실제 도입 시에는 Bedrock 웹 검색의 데이터 통제, AgentCore의 실행 비용, Dogwood 기반 정책 설계, DynamoDB 벡터 검색의 데이터 규모를 함께 검토하는 것이 좋다.

원문 읽기(새 탭에서 열림)
cloudflare4분 읽기큐레이션 요약

자연재해와 정부 개입: 2026년 2분기 주요 인터넷 장애 사건 분석

인터넷 장애는 자연재해·정전 같은 물리적 사건부터 정부의 의도적 차단, 클라우드 인프라 손상, DNSSEC 설정 오류까지 다양한 원인으로 발생하며, 서로 다른 원인도 사용자에게는 비슷한 “연결 불가”로 나타난다. Cloudflare Radar의 Q2 2026 분석은 이란의 88일 인터넷 차단 종료, 괌 태풍, 수단·이라크의 시험 기간 차단, 독일 `.de` 도메인 장애 등을 통해 인터넷의 취약성과 동시에 높은 복원력을 보여준다. 다만 이 글은 모든 이상 현상이 아니라 확인된 주요 장애 사례를 다룬다. ### 자연재해와 정전이 네트워크에 미친 영향 - **괌의 슈퍼태풍 신라쿠** - 4월 중순 태풍이 괌 북쪽을 지나가며 열대폭풍급 강풍과 광범위한 정전을 일으켰다. - 전력과 수도 시스템이 영향을 받으면서 4월 13~14일 인터넷 트래픽이 예상치보다 최대 80% 감소했다. - 섬이 태풍의 직접적인 타격을 피했음에도 디지털 연결성이 크게 흔들렸다. - **베네수엘라 지진** - 6월 24일 북부 베네수엘라에서 규모 7.5 지진과 추가 지진이 연이어 발생했다. - 지진 발생 시점에 HTTP 전송 바이트가 급격히 감소했으며, Fibex Telecom, CANTV, VNET 등 주요 ISP에서 동일한 현상이 관측됐다. - 특히 약 160만 명의 사용자를 보유한 것으로 추정되는 Fibex Telecom에서 감소가 뚜렷했다. - **탄자니아 정전** - 6월 27일 발생한 정전으로 인터넷 트래픽이 최소 5시간 동안 급락했다. - 원인은 정부의 의도적 차단이 아니라 전력 인프라 장애였지만, 사용자에게 나타난 결과는 통신과 뉴스 접근이 불가능해지는 등 과거의 국가적 차단과 유사했다. - 서로 다른 사건도 데이터상으로는 “트래픽의 급격한 소실”이라는 비슷한 패턴을 남긴다. - 이러한 사례는 전력 공급, 라우팅 경로, 물리적 회선의 중복성을 확보해야 인터넷이 외부 충격을 견딜 수 있음을 보여준다. ### 정부 정책과 지정학적 갈등에 따른 접속 제한 - **이란의 인터넷 복구** - 2월 28일부터 이어진 약 88일간의 전국적 인터넷 차단이 5월 26일부터 점진적으로 해제되기 시작했다. - 5월 27일 트래픽은 차단 전의 약 40%까지 회복됐고, 이후 최대 90%까지 상승한 뒤 약 59% 수준으로 안정됐다. - 완전한 정상화라기보다 최근 차단 이전 수준에 가까운 부분적 복구로 평가된다. - 2026년 월드컵 분석에서도 이란의 트래픽은 경기 일정이 아니라 차단과 복구의 극적인 대비에 의해 좌우됐다. - **중동 분쟁과 AWS 인프라 손상** - UAE의 AWS `me-central-1` 리전 트래픽은 계속 낮은 수준을 유지했다. - 드론 공격으로 UAE와 바레인의 데이터센터 시설이 물리적 피해를 입었고, AWS는 UAE 리전이 고객 애플리케이션을 안정적으로 지원하지 못한다고 밝혔다. - 이는 네트워크 자체의 장애가 아니라 데이터센터 손상이 해당 리전에 호스팅된 웹사이트와 애플리케이션에 영향을 준 사례다. - **시험 기간의 국가 인터넷 차단** - 이라크에서는 6월 2일, 11일, 28일 세 차례 차단이 발생했으며 각각 약 90분간 지속됐다. - 수단에서는 4월 13~23일 사이 열 차례 차단이 시행됐고, 매번 약 3.5시간 동안 이어졌다. - 두 국가 모두 국가시험 부정행위를 막기 위해 시험 시간에 맞춰 접속을 차단했다. - 정부는 국가 인터넷을 완전히 끄거나, 속도를 낮추거나, 일부 사용자에게만 재개하는 등 정책적으로 연결성을 통제할 수 있다. ### DNSSEC 오류로 발생한 독일 `.de` 도메인 장애 - 5월 5일 독일 국가 코드 도메인 `.de`를 관리하는 DENIC의 DNSSEC 키 교체 과정에서 잘못된 서명이 생성됐다. - DNSSEC 검증 리졸버는 서명이 현재 공개된 키와 일치하지 않으면 DNS 응답을 위조나 변조로 간주한다. - 그 결과 전 세계 검증 리졸버가 `.de` 도메인 요청을 거부하고 `SERVFAIL` 오류를 반환했다. - 장애는 5월 6일 23:15 UTC에 정상화됐다. - 장애 중 `.de` 질의량이 오히려 증가했는데, 실패한 응답은 캐시에 저장되지 않아 사용자의 재시도와 반복 조회가 늘어났기 때문이다. - 사용자는 암호화 서명 문제를 직접 인식하기보다 독일 도메인의 웹사이트와 서비스가 갑자기 열리지 않는 현상으로 경험했다. ### 해저 케이블과 지역 인프라의 취약성 - 세인트루시아에서는 해저 케이블 절단이 지역 인터넷 연결을 약화시켰다. - 이 사건은 특정 국가나 지역의 국제 연결이 제한된 수의 물리적 케이블에 의존할 경우, 단일 절단만으로도 사용자 접속이 크게 영향을 받을 수 있음을 보여준다. - DNSSEC 장애와 케이블 절단은 원인은 다르지만, 인터넷 서비스가 정상적으로 보이기 위해서는 암호화 검증 체계와 물리적 전송 경로가 모두 안정적으로 운영되어야 한다는 점을 공통적으로 드러낸다. 인터넷 회복력을 높이려면 전력·라우팅·해저 케이블·데이터센터의 중복성을 확보하고, DNSSEC 키 교체 같은 정기 유지보수에는 철저한 검증 절차를 적용해야 한다. 또한 정부와 사업자가 연결성을 정책적으로 차단할 수 있는 만큼, 장애 원인이 기술적 고장인지 의도적 차단인지 구분해 모니터링하는 것도 중요하다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

AWS 주간 요약: 아테네 로컬 영역, AWS의 Claude Opus 5, .NET용 Lambda 내구성 실행 및 기타 소식 (2026년 7월 27일) | Amazon Web Services

AWS는 인프라를 사용자와 데이터가 있는 지역에 더 가깝게 배치하고, AI·서버리스·관측성 기능을 강화하는 업데이트를 발표했다. 그리스 아테네 Local Zone, Amazon Bedrock의 Claude Opus 5, .NET용 Lambda durable execution 등이 대표적이다. 또한 에이전트 품질 평가, 멀티 리전 복원력, AI 코딩 도구의 효과 측정처럼 운영 단계의 실용성도 강조됐다. ## 아테네 AWS Local Zone 개설 - 그리스 아테네에 AWS Local Zone이 개설됐다. - EMEA 지역에서 Amazon S3와 Amazon EBS Local Snapshots를 지원하는 두 번째 Local Zone이다. - 지원 서비스: - Amazon EC2 C7i, M7i, R7i 인스턴스 - Amazon S3 One Zone-Infrequent Access - Amazon EBS - Amazon ECS - 데이터를 그리스 내에서 저장·처리할 수 있어 데이터 레지던시 요구사항 대응에 유리하다. - 대규모 사용자·산업 거점 가까이에서 한 자릿수 밀리초 지연 시간을 제공해 실시간 게임, 미디어 제작, 금융 서비스 등에 적합하다. - 지연 시간이 중요한 워크로드는 아테네에서 실행하고, 나머지 AWS 서비스는 인접 리전과 연결하는 하이브리드 아키텍처를 구성할 수 있다. ## Amazon Bedrock의 Claude Opus 5 - Anthropic의 최신 Opus급 모델인 Claude Opus 5를 AWS에서 사용할 수 있게 됐다. - Amazon Bedrock과 AWS 기반 Claude Platform을 통해 접근할 수 있다. - Amazon Bedrock에서는 zero data retention(ZDR)이 기본 활성화되어 데이터 거버넌스 요구사항을 충족하는 데 도움이 된다. - 고도의 지능이 필요한 애플리케이션에서 Opus급 가격으로 사용할 수 있다는 점이 강조됐다. ## .NET용 Lambda durable execution 정식 출시 - C# 개발자는 사용자 정의 진행 상태 추적이나 외부 오케스트레이션 서비스 없이 장기 실행 워크플로를 구축할 수 있다. - SDK가 실행 진행 상황을 자동으로 체크포인트에 저장한다. - 워크플로를 최대 1년까지 일시 중지할 수 있다. - 적합한 사용 사례: - 결제 처리 파이프라인 - AI 에이전트 오케스트레이션 - 사람의 승인이 필요한 human-in-the-loop 프로세스 - 기존에 개발자가 직접 구현해야 했던 재시도, 상태 저장, 재개 로직을 줄여준다. ## Bedrock AgentCore 관측성 통합 - 에이전트의 트레이스와 프롬프트가 에이전트 로그와 동일한 CloudWatch 로그 그룹에 저장된다. - 기존에는 트레이스와 프롬프트·입출력 데이터가 서로 다른 위치에 저장되어 단일 호출을 분석하기 어려웠다. - 이제 한 곳에서 에이전트 호출을 추적하고 디버깅할 수 있다. - 에이전트 단위로 세밀한 접근 제어와 고객 관리형 키(CMK) 암호화를 적용할 수 있다. ## Amazon Connect의 다국어 음성 에이전트 - 50개 이상의 언어에서 더 자연스럽고 인간적인 음성 기반 AI 경험을 제공한다. - 포르투갈어, 스페인어, 프랑스어, 이탈리아어, 일본어, 한국어, 태국어 등을 지원한다. - 100개 이상의 새로운 음성 옵션과 대화 품질 개선이 추가됐다. - AI 에이전트가 음성·디지털 채널에서 고객의 의도와 감정, 말투를 이해하고 필요한 작업을 수행할 수 있다. - 다국어 고객센터와 자연스러운 셀프서비스 구축에 활용할 수 있다. ## SageMaker Unified Studio와 OpenSearch 통합 - SageMaker Unified Studio에서 Amazon OpenSearch의 검색·로그 분석 데이터를 직접 조회하고 분석할 수 있다. - OpenSearch 데이터를 Amazon Redshift, Amazon S3, 관계형 데이터베이스의 데이터와 함께 다룰 수 있다. - 운영 데이터와 분석 데이터를 결합해 애플리케이션 로그와 트랜잭션 데이터를 연계 분석하는 데 유용하다. - 여러 데이터 소스를 하나의 거버넌스 환경에서 관리할 수 있다는 점이 핵심이다. ## CloudWatch 코딩 에이전트 인사이트 - 조직 내 AI 코딩 도구가 실제로 어떤 가치를 창출하는지 측정할 수 있다. - Claude apps gateway for AWS를 통해 Claude Code의 텔레메트리를 별도 계측 없이 수집한다. - Codex와 GitHub Copilot 같은 다른 코딩 에이전트도 지원한다. - OpenTelemetry 기반 지표로 AI 코딩 도구 도입 효과와 투자수익을 분석할 수 있다. ## 추가 AWS 소식과 행사 - Strands Agents와 Bedrock AgentCore를 활용해 AI 에이전트를 프로덕션 전후로 체계적으로 평가하는 가이드가 소개됐다. - CloudFormation custom resource를 멀티 리전 구조로 설계해 특정 리전 장애에도 배포 안정성을 유지하는 방법이 다뤄졌다. - Amazon SES에 이메일 발송량 증가에 대응할 수 있는 예측 가능한 가격제가 추가됐다. - AWS Summits와 AWS Community Days 등 2026년 하반기 개발자·클라우드 행사가 안내됐다. 실무적으로는 지역 데이터 보존이 필요하면 아테네 Local Zone을 검토하고, .NET 기반 장기 워크플로에는 Lambda durable execution을 활용할 만하다. AI 에이전트를 운영 중이라면 AgentCore의 통합 로그와 체계적인 평가 방법을 함께 도입하는 것이 효과적이다.

원문 읽기(새 탭에서 열림)
slack5분 읽기큐레이션 요약

Shipyard: Slack의 차세대 EC2 플랫폼을 구축한 방법

Slack은 장기 실행 EC2 인스턴스를 지속적으로 수정하는 기존 운영 방식의 한계를 해결하기 위해 차세대 EC2 플랫폼인 Shipyard를 구축했다. Shipyard는 EC2를 계속 변경되는 서버가 아니라 빌드·배포 가능한 불변 아티팩트로 다루며, 점진적 배포와 메트릭 기반 자동 중단·롤백을 지원한다. 이를 통해 컨테이너로 전환하기 어려운 워크로드에도 현대적인 배포 안정성과 예측 가능성을 제공한다. ## 기존 EC2 운영 방식의 한계 - Chef 기반으로 장기간 실행되는 인스턴스를 계속 업데이트하는 방식은 다음 문제를 낳았다. - 서비스 단위 배포가 복잡함 - 인프라 드리프트가 시간이 지날수록 누적됨 - 여러 계층의 변경 사항을 조율해야 함 - 수동 변경과 자동 설정 적용이 충돌할 수 있음 - Slack은 기존 Chef 환경을 다중 스택, 버전 관리, 분리된 프로덕션 환경, 신호 기반 실행 등으로 개선했지만 근본적인 구조적 한계는 남아 있었다. - 컨테이너가 일부 문제를 해결했지만 인프라 컴포넌트, Kubernetes 워커 노드, egress 네트워크 스택 등은 쉽게 컨테이너화하기 어려웠다. ## Shipyard의 핵심 방향 - 인스턴스를 지속적으로 수정하는 대신 이미지와 배포 산출물을 중심으로 운영한다. - 서비스 단위 배포 기능을 제공해 애플리케이션 배포와 유사한 방식으로 EC2 인프라를 관리한다. - 빌드 파이프라인, 배포 오케스트레이션, 자동 안전 장치를 긴밀하게 연동한다. - 인프라 변경을 불변성, 점진적 롤아웃, 자동화된 안전 검증을 갖춘 배포 과정으로 전환한다. ## 멀티 아키텍처와 멀티 운영체제 - AMD64와 ARM 기반 AWS Graviton 인스턴스를 모두 지원한다. - Ubuntu, RHEL, Amazon Linux 등 여러 운영체제를 사용할 수 있다. - 비용, 성능, 호환성에 따라 서비스별 실행 환경을 선택할 수 있다. - 컨테이너 전환이 어려운 다양한 EC2 워크로드를 동일한 플랫폼에서 운영할 수 있다. ## 메트릭 기반 점진적 배포 - Shipyard는 Slack의 배포 오케스트레이션 시스템인 Gondola와 통합된다. - 배포 과정에서 서비스 상태 지표를 기반으로 자동 안전 검사를 수행한다. - 오류율, 성능 저하 등 서비스 헬스 신호가 나빠지면 배포를 자동으로 중단할 수 있다. - 문제가 발생하면 이전의 정상 버전으로 자동 롤백할 수 있다. - 따라서 배포 실패의 영향 범위를 줄이고, 운영자의 수동 판단 의존도를 낮춘다. ## 계층형 이미지와 빠른 프로비저닝 - 컨테이너 이미지와 유사한 계층형 이미지 구조를 사용한다. - 공통 인프라 요소를 포함한 골든 베이스 이미지를 먼저 만들고, 그 위에 서비스별 이미지를 쌓는다. - 인스턴스 시작 시 수행해야 할 작업을 줄여 리전 간에도 빠르고 예측 가능한 프로비저닝이 가능하다. - 실행 시점에 많은 설정을 적용하던 기존 방식보다 부팅 과정의 변동성이 작다. ## 설정 관리 방식의 변화 - 기존에는 실행 중인 인스턴스가 주기적으로 Chef 작업을 실행해 설정을 확인하고 원하는 상태로 되돌렸다. - Shipyard에서는 이미지 생성과 초기 프로비저닝 같은 명확한 수명 주기 단계에서 설정을 적용한다. - 설정 관리 도구는 시스템 전체를 계속 수정하기보다 서비스 배포에 집중한다. - 이 방식의 장점은 다음과 같다. - 백그라운드 작업 부하 감소 - 수동 변경의 의도치 않은 덮어쓰기 방지 - 시간이 지나면서 인스턴스 상태가 달라지는 현상 감소 - 시스템 동작과 장애 원인 분석의 단순화 ## Peekaboo 기반 실시간 인벤토리 - Shipyard는 EC2 플릿을 거의 실시간으로 확인하기 위한 인벤토리 시스템 Peekaboo를 제공한다. - 기존처럼 Chef Server를 단일 정보 원천으로 사용하지 않고 AWS 이벤트와 인스턴스 메타데이터를 직접 활용한다. - Shipyard로 배포되지 않은 인스턴스도 추적해 전체 EC2 플릿을 한곳에서 확인할 수 있다. - AWS EventBridge, OpenSearch, Lambda를 기반으로 구축되었다. - UI, API, CLI를 제공해 다음 작업을 지원한다. - 전체 인스턴스 상태 탐색 - 다른 시스템과의 통합 - 명령줄에서 빠른 상태 확인 - 중앙화된 가시성을 통해 어떤 인스턴스가 어디에 있고 어떤 상태인지 파악하기 쉬워진다. ## 짧은 수명의 불변 인스턴스 - 각 EC2 인스턴스에 제한된 수명을 부여하고 정기적으로 자동 교체한다. - 인스턴스를 직접 수정해 오래 유지하기보다 새 이미지를 배포해 교체하는 방식을 채택한다. - 보안 취약점이 노출된 채 남아 있는 시간을 줄일 수 있다. - 운영팀은 개별 서버를 고치는 대신 최신 이미지를 기반으로 인스턴스를 재생성하는 데 집중한다. - 결과적으로 EC2 플릿의 상태를 지속적으로 신선하게 유지할 수 있다. ## Golden Base Image인 slack-zero - Shipyard의 기반에는 Slack Compute Platform Team이 관리하는 공통 이미지 `slack-zero`가 있다. - 보안 및 모니터링 팀과 협력해 표준화된 기반 환경을 유지한다. - 포함 내용: - 운영체제 기본 설정과 보안 강화 - 네트워크 및 서비스 디스커버리 설정 - 모니터링·보안 에이전트 - 공통 도구와 기반 시스템 설정 - 서비스는 `slack-zero`를 기반으로 필요한 런타임과 애플리케이션 요소를 추가한다. - 기반 이미지는 불변이지만 영구적으로 유지하지는 않는다. - 보안 패치, 모니터링 업데이트, 네트워크 개선이 필요하면 새 이미지를 생성한다. - 서비스 이미지는 최신 `slack-zero`를 기반으로 다시 빌드해 변경 사항을 상속한다. ## AWS Image Builder 활용 - Slack은 기존 Packer 대신 AWS Image Builder를 사용해 `slack-zero`를 생성한다. - AWS Image Builder의 장점으로 다음이 언급된다. - 수명 주기 정책을 통한 오래된 AMI 자동 정리 - AMI 저장 비용 절감 - 새 이미지가 생성될 때 SSM Parameter에 최신 AMI 정보를 게시 - 이를 통해 서비스 이미지 빌드와 인스턴스 교체 과정에서 최신 기반 이미지를 일관되게 참조할 수 있다. Shipyard의 핵심은 EC2를 수동으로 계속 관리하는 서버가 아니라, 버전이 지정된 이미지로 빌드하고 안전하게 교체하는 배포 대상으로 바꾸는 데 있다. EC2를 계속 사용해야 하지만 컨테이너의 불변성, 계층형 이미지, 점진적 배포, 자동 롤백의 이점을 원하는 조직이라면 이와 같은 플랫폼 접근이 효과적이다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

Amazon SQS 20주년: 대규모 환경에서 20년간 이어온 안정적인 메시징 | Amazon Web Services

Amazon SQS는 서비스 간 결합도를 낮추고 장애 전파를 막기 위해 메시지를 비동기적으로 전달하는 AWS의 관리형 메시지 큐 서비스다. 출시 20년 동안 FIFO 고처리량, 암호화 기본 적용, DLQ 복구, 대규모 메시지 처리 등 기능이 크게 발전했지만, 서비스 간 분리·트래픽 버퍼링·장애 격리라는 핵심 역할은 변하지 않았다. 최근에는 멀티테넌트 시스템과 AI 에이전트·추론 워크로드에도 활용 범위가 확대되고 있다. ## 비동기 메시징을 통한 서비스 결합도 완화 - 서비스가 서로 직접 호출하면 호출 대상의 지연이나 장애가 연쇄적으로 전체 시스템에 영향을 줄 수 있다. - SQS를 사용하면 생산자는 메시지를 큐에 저장한 뒤 작업을 계속하고, 소비자는 처리 가능한 시점에 메시지를 가져갈 수 있다. - 이를 통해 다음과 같은 효과를 얻는다. - 서비스 간 의존성 및 결합도 감소 - 트래픽 급증 시 메시지 큐를 버퍼로 활용 - 특정 서비스 장애가 전체 시스템으로 확산되는 것을 방지 - 소비자의 처리 속도에 맞춘 안정적인 작업 처리 ## FIFO 큐의 처리량과 동시성 향상 - 2021년 FIFO 큐 고처리량 모드가 출시되며 API 작업당 초당 3,000건(TPS)을 지원했다. - 이후 처리량이 단계적으로 증가했다. - 2022년: 6,000 TPS - 2023년 8월: 9,000 TPS - 2023년 10월: 18,000 TPS - 2023년 11월: 일부 리전에서 최대 70,000 TPS - 2024년에는 FIFO 큐의 인플라이트 메시지 한도가 20,000개에서 120,000개로 증가했다. - 소비자가 동시에 처리할 수 있는 메시지가 늘어나 대규모 순서 보장 처리에 유리해졌다. ## 암호화와 세분화된 접근 제어 - 2021년 SQS 관리형 키를 사용하는 서버 측 암호화 방식인 SSE-SQS가 도입됐다. - 2022년 10월부터 새로 생성되는 큐에는 SSE-SQS가 기본 적용됐다. - 고객이 직접 암호화 키를 생성하고 관리하지 않아도 메시지를 보호할 수 있다. - 2022년에는 ABAC(Attribute-Based Access Control)가 추가됐다. - 큐의 고정된 리소스 정책 대신 태그를 기준으로 권한을 부여할 수 있다. - 큐와 환경이 늘어나는 대규모 시스템에서 권한 정책 관리 부담을 줄인다. ## DLQ 메시지 복구 기능 강화 - 처리에 실패한 메시지를 보관하는 Dead-Letter Queue(DLQ)에서 원래 큐로 메시지를 되돌리는 기능이 단계적으로 확대됐다. - 2021년에는 SQS 콘솔에서 DLQ 메시지를 소스 큐로 직접 재전송할 수 있게 됐다. - 2023년에는 SDK와 CLI에서도 다음 API를 사용할 수 있게 됐다. - `StartMessageMoveTask`: 메시지 이동 작업 시작 - `CancelMessageMoveTask`: 이동 작업 취소 - `ListMessageMoveTasks`: 이동 작업 목록 조회 - 같은 해 FIFO 큐에도 redrive 기능이 지원됐다. - 운영 중 실패한 메시지를 수동으로 재처리하거나 별도 개발 없이 복구할 수 있다. ## 메시지 처리 성능과 연동성 개선 - 2023년 AWS SDK에 JSON 프로토콜 지원이 추가됐다. - 5KB 페이로드 기준 종단 간 처리 지연을 최대 23% 줄이고, 클라이언트의 CPU·메모리 사용량도 낮췄다. - SQS 콘솔에서 EventBridge Pipes와 큐를 직접 연결할 수 있게 됐다. - 별도의 통합 코드를 작성하지 않고도 큐 메시지를 다양한 AWS 서비스 대상으로 라우팅할 수 있다. ## 대용량 메시지와 페이로드 확장 - 2024년 Python용 Extended Client Library가 제공됐다. - 최대 2GB 크기의 메시지를 Amazon S3에 저장하고, SQS에는 해당 데이터의 참조 정보만 전달할 수 있다. - 2025년에는 표준 큐와 FIFO 큐의 최대 메시지 크기가 256KiB에서 1MiB로 증가했다. - AWS Lambda의 SQS 이벤트 소스 매핑도 이 새로운 페이로드 크기를 지원하도록 업데이트됐다. ## 멀티테넌트 환경을 위한 공정한 처리 - 2025년 표준 큐에 fair queues가 도입됐다. - 메시지를 보낼 때 메시지 그룹 ID를 포함하면 특정 테넌트가 큐를 독점하는 ‘시끄러운 이웃(noisy neighbor)’ 문제를 완화할 수 있다. - 소비자 측 코드를 변경하지 않고도 한 테넌트의 대량 메시지가 다른 테넌트의 처리 지연을 유발하는 상황을 줄일 수 있다. ## AI 시스템으로 확장되는 SQS의 활용 - SQS의 기본 패턴은 AI 워크로드에도 적용된다. - 활용 사례는 다음과 같다. - 대규모 언어 모델 요청을 큐에 저장해 추론 요청량 조절 - 추론 처리량을 소비자 수와 처리 속도에 맞춰 관리 - 독립적으로 동작하는 AI 에이전트 간 작업과 통신 조정 - AI 서비스가 일시적으로 느려지거나 중단돼도 요청을 큐에 보관해 전체 시스템의 안정성을 유지할 수 있다. 실무에서는 서비스 간 직접 호출이 장애 전파나 트래픽 급증 문제를 일으키는 경우 SQS를 우선 검토할 수 있다. 순서 보장과 중복 처리 방지가 필요하면 FIFO 큐를, 실패 메시지 복구가 중요하면 DLQ와 redrive 기능을 함께 설계하는 것이 좋다.

원문 읽기(새 탭에서 열림)
aws5분 읽기큐레이션 요약

AWS 주간 정리: 1주년을 맞은 AWS Builder Center, Security Hub의 네트워크 스캐닝, AWS용 Loom 등 (2026년 7월 13일) | Amazon Web Services

AWS Builder Center가 출범 1주년을 맞아 샌드박스, 워크숍, 커뮤니티 기능을 갖춘 AWS 학습·개발 생태계로 확장됐다. 동시에 AWS Security Hub의 네트워크 스캐닝 및 Azure 지원, SageMaker와 Hugging Face 통합, GPU 관리 비용 인하, Aurora DSQL CDC 정식 출시 등 주요 서비스 업데이트가 발표됐다. AWS는 보안·AI 에이전트·멀티클라우드 관리 기능을 통합해 개발 편의성과 운영 자동화를 강화하는 방향을 보이고 있다. ## AWS Builder Center의 1년 성장 - 2025년 7월 9일 출시 이후 커뮤니티 허브에서 종합 개발자 생태계로 확장됐다. - 주요 기능: - AWS 리전별 서비스 현황 - 커뮤니티가 직접 만드는 Spaces - 카테고리·난이도별 워크숍 - 배지와 연속 활동 기록 - 아티클 시리즈, 조회 수, 저장 항목 - 학생 상태 및 서비스 출시 알림 - GitHub·Amazon 계정 로그인 - 무료 샌드박스 환경 - 5,548명의 작성자가 6,448개 아티클을 게시했으며, 누적 조회 수는 1,040만 회를 넘었다. - 2026년 3월 배지 시스템 출시 후 약 99,226개의 배지가 발급됐다. - 사용자 요청 565건 중 10건이 실제 출시됐고, 20건은 단기 로드맵에 포함됐다. - 인기 글: - MCP와 Strands Agents SDK 기반 AWS Study Buddy: 5만 회 이상 - Kiro를 활용한 EOL Linux 서버 AWS 이전: 4만 5천 회 이상 - 신경 질환 조기 검사를 위한 멀티모달 AI: 3만 8천 회 이상 ## 8시간짜리 무료 AWS 샌드박스 - 워크숍 실습을 위해 사전 구성된 무료 AWS 계정을 제공한다. - 개인 AWS 계정, 신용카드, 수동 리소스 정리가 필요 없다. - 환경은 최대 8시간 동안 활성화되며 이후 계정과 리소스가 자동으로 제거된다. - 한 번에 하나의 샌드박스만 사용할 수 있고, 주 1회 신청할 수 있다. - AWS 서비스를 안전하게 실습하거나 교육용 워크숍을 진행하는 데 적합하다. ## Security Hub의 네트워크 및 멀티클라우드 보안 - **Network Scanning**은 실제 인터넷에서 리소스에 접근 가능한지를 직접 확인한다. - AWS와 Azure 환경에서 다음 리소스를 탐색한다. - 공용 IP 주소 - 가상 머신 - 로드 밸런서 - 접근 가능한 포트와 해당 포트에서 실행 중인 서비스를 식별한다. - 접근 가능한 포트마다 발견 근거와 함께 Security Hub finding을 생성한다. - 기존 네트워크 도달 가능성 분석이 “도달 가능하게 만들 수 있는 구성”을 찾는다면, Network Scanning은 실제 인터넷 도달 여부를 검증한다. - Security Hub Exposures가 관련 설정 및 보안 결과를 결합해 전체적인 위험도를 계산한다. - 신규 고객에게는 기본 활성화되며, 기존 고객은 계정·리전별 또는 조직 정책으로 활성화할 수 있다. - Security Hub Essentials에 추가 비용 없이 포함된다. - Azure 리소스도 자동 검색해 다음 항목을 통합 관리한다. - VM, 컨테이너 이미지, Function Apps, ID - 설정 오류, 인터넷 노출, 소프트웨어 취약점 - AWS와 Azure의 보안 결과를 동일한 형식과 자동화 흐름으로 한 화면에서 관리할 수 있다. ## SageMaker Studio와 Hugging Face 통합 - Hugging Face에서 모델을 선택한 뒤 한 번의 클릭으로 SageMaker Studio에서 커스터마이즈하거나 배포할 수 있다. - 지원 모델에는 다음 작업 흐름이 제공된다. - SageMaker에서 모델 커스터마이즈 - SageMaker 또는 Bedrock 엔드포인트 배포 - 모델 평가 - 사용자 정의 보상 함수를 활용한 강화학습 파인튜닝 - 신규 고객은 사전 구성된 권한과 환경을 갖춘 Studio를 빠르게 생성할 수 있다. - 검증된 고객은 별도 쿼터 증액 요청 없이 G5, G6, G4dn GPU 인스턴스에 기본 접근할 수 있다. - Studio 내부에서 GPU 쿼터 사용량도 확인할 수 있다. ## GPU 관리 비용 인하 - 2026년 7월 1일부터 EKS Auto Mode와 ECS Managed Instances의 가속 인스턴스 관리 비용이 자동으로 인하된다. - 인하 폭: - G 계열: 35% - P 계열 및 AWS Trainium: 60% - 기존 클러스터에도 자동 적용되며 별도 작업이 필요 없다. - EKS Auto Mode: - GPU 인스턴스의 병렬 이미지 풀링 - 로컬 NVMe 기반 가속 워크로드 지원 - 가속기 상태를 인식한 노드 복구 - ECS Managed Instances: - CloudWatch Container Insights 기반 GPU 메트릭 - GPU 하드웨어 장애 자동 모니터링 ## Aurora DSQL의 변경 데이터 캡처 - Aurora DSQL CDC가 정식 출시됐다. - INSERT, UPDATE, DELETE 결과를 변경 이벤트로 만들어 Amazon Kinesis Data Streams에 전송한다. - 활용 사례: - 마이크로서비스 간 데이터 동기화 - Lambda 함수 트리거 - Firehose를 통한 S3, Redshift, OpenSearch Service 전달 - 데이터베이스 워크로드 성능에 영향을 주지 않도록 설계됐다. - CDC 인프라를 별도로 구축하거나 운영할 필요가 없다. ## AWS용 Loom과 안전한 AI 에이전트 운영 - Loom은 AWS Strands Agents와 Amazon Bedrock AgentCore Runtime 기반 에이전트를 구축·배포하는 오픈소스 엔터프라이즈 플랫폼이다. - 제공 기능: - 통합 관리 UI와 백엔드 API - ID 공급자 연동 - 범위 기반 권한 제어 - 멀티 페르소나 탐색 - 에이전트, 메모리, MCP 서버, 에이전트 간 연동의 전체 수명주기 관리 - 멀티테넌트 환경을 위해 RBAC와 ABAC를 지원한다. - 리소스 태깅을 자동화해 비용을 사용자·팀별로 추적할 수 있다. - 표준화된 배포 블루프린트, AWS Agent Registry 연동, 민감한 작업 전 사람의 검토 절차도 제공한다. - AWS Labs GitHub에서 프로젝트를 확인할 수 있다. ## Claude 애플리케이션 접근 제어 - Claude Code와 Claude Desktop에 대한 접근, 비용, 정책을 중앙에서 관리하는 자체 호스팅 게이트웨이가 소개됐다. - OIDC 호환 ID 공급자와 연동하며, 모든 요청에 관리형 설정을 적용한다. - Amazon Bedrock 또는 AWS 기반 Claude Platform으로 추론 요청을 라우팅할 수 있다. - 사용자·그룹별 지출 한도를 설정할 수 있다. - 프라이빗 네트워크의 무상태 컨테이너로 실행되며, PostgreSQL은 단기 로그인 상태만 저장한다. - 개발자 장비에 장기 보안 키를 저장하지 않는 방식으로 보안을 강화한다. ## AWS MCP Server의 OAuth 지원 - AWS Console이나 CLI와 동일한 자격 증명을 사용해 브라우저 기반 OAuth로 AWS MCP Server에 연결할 수 있다. - IAM Federation, AWS IAM Identity Center, 루트 사용자 및 IAM 사용자를 지원한다. - AWS Sign-In이 단기 액세스·리프레시 토큰을 발급하고 토큰 갱신을 자동 처리한다. - 개발자는 재시작 후에도 반복 로그인 없이 에이전트를 인증 상태로 유지할 수 있다. AWS를 학습하거나 실험하려는 경우 Builder Center의 샌드박스와 워크숍을 활용하면 비용과 정리 부담을 줄일 수 있다. 운영 환경에서는 Security Hub의 실제 인터넷 도달성 검사와 Azure 통합을 우선 검토하고, AI 에이전트 도입 시에는 Loom·OAuth·중앙 정책 관리 기능을 통해 권한, 비용, 감사 체계를 함께 설계하는 것이 바람직하다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

AWS 주간 요약: AWS에서 제공되는 Claude Sonnet 5, AI 에이전트를 위한 Amazon WorkSpaces, AWS 서비스 가용성 업데이트 등 (2026년 7월 6일) | Amazon Web Services

AWS는 이번 주 Claude Sonnet 5, AI 에이전트용 Amazon WorkSpaces, 로그 분석 최적화 OpenSearch 등 AI·인프라 관련 기능을 대거 공개했다. 특히 CloudFormation Express, EKS 버전 롤백, ACM의 ACME 지원처럼 개발·운영 속도와 안정성을 높이는 기능도 강화됐다. 동시에 여러 AWS 서비스와 기능이 유지보수 단계, 일몰 또는 지원 종료로 전환되므로 사용 중인 서비스의 마이그레이션 계획을 점검해야 한다. ## 주요 출시 및 업데이트 ### Graviton5 기반 Amazon EC2 C9g/C9gd - AWS Graviton5 프로세서를 탑재한 컴퓨팅 최적화 인스턴스다. - Graviton4 기반 인스턴스보다 최대 25% 향상된 컴퓨팅 성능을 제공한다. - 캐시 용량이 5배 커졌으며, 클라우드 프로세서 중 가장 빠른 메모리 성능을 제공한다. - C9gd는 로컬 NVMe 스토리지를 지원해 고성능 임시 데이터 처리에 적합하다. ### AWS CloudFormation Express 모드 - 인프라 배포 결과를 수초 내에 확인할 수 있도록 배포 흐름을 단축한다. - AI 에이전트와 개발자가 배포 결과를 빠르게 확인하고 반복 작업을 수행할 수 있다. - 모든 상용 AWS 리전에서 추가 비용 없이 제공된다. ### Amazon EKS Kubernetes 버전 롤백 - Kubernetes 클러스터 업그레이드 후 최대 7일 동안 이전 버전으로 되돌릴 수 있다. - 업그레이드 실패 시 클러스터를 새로 구축하지 않아도 된다. - Kubernetes 버전 업그레이드를 되돌릴 수 있는 저위험 작업으로 만들어 운영 안정성을 높인다. ### AWS Certificate Manager의 ACME 지원 - 표준 ACME 프로토콜을 사용해 퍼블릭 TLS 인증서 발급과 갱신을 자동화할 수 있다. - 기존 ACME 기반 도구 및 자동화 파이프라인과 연동하기 쉬워졌다. - 인증서 만료로 인한 서비스 중단 위험을 줄일 수 있다. ## AI 및 개발 생산성 기능 ### AWS에서 제공되는 Claude Sonnet 5 - Anthropic의 최신 Sonnet 모델로, 코딩·에이전트 작업·일반 업무를 대상으로 한다. - 대규모 코드베이스를 탐색하고 도구를 정확하게 호출할 수 있다. - 장시간 이어지는 에이전트 작업에서 상태를 유지하도록 설계됐다. - Sonnet 계열의 가격대에서 높은 수준의 추론 성능을 제공하는 것이 특징이다. ### AI 에이전트용 Amazon WorkSpaces - AI 에이전트가 관리형 WorkSpaces 환경에서 데스크톱 애플리케이션에 안전하게 접근하고 조작할 수 있다. - 기존 애플리케이션을 현대화하거나 별도의 맞춤형 통합을 구현하지 않아도 된다. - 레거시 GUI 애플리케이션을 AI 자동화 workflow에 포함할 수 있는 기반을 제공한다. - 정식 출시(GA) 단계로 제공된다. ### Amazon SageMaker AI 추론 확장 속도 개선 - 컨테이너 이미지 캐싱을 지원해 생성형 AI 모델의 scale-out 시간을 줄인다. - 추론 확장 이벤트에서 엔드투엔드 확장 속도가 최대 2배 빨라질 수 있다. - 트래픽 급증 시 새 추론 인스턴스를 준비하는 시간을 단축한다. ## 데이터 분석 및 모니터링 개선 ### 로그 분석에 최적화된 Amazon OpenSearch Service - 로그 분석 workload를 위해 별도로 설계된 새로운 엔진을 제공한다. - AWS 내부 벤치마크 기준 최대 4배 향상된 가격 대비 성능을 목표로 한다. - 로그 집계와 정밀한 전문 검색을 하나의 시스템에서 함께 수행할 수 있다. - 검색 기능과 분석 기능을 별도 시스템으로 분리해야 하는 부담을 줄인다. ### CloudWatch 로그 쿼리 기반 알람 - 로그 쿼리 결과에 직접 임계값을 설정해 알람을 만들 수 있다. - 기존처럼 먼저 메트릭 필터나 사용자 지정 메트릭을 생성할 필요가 없다. - 로그 분석과 장애 알림 설정을 하나의 workflow로 처리할 수 있다. ## AWS 서비스 가용성 변경 AWS는 서비스 또는 기능의 제공 상태가 바뀔 때 대체 서비스와 마이그레이션 지침을 제공한다. 2026년 6월 30일 기준으로 다음과 같은 변경이 발표됐다. ### 신규 고객 접근이 제한되는 유지보수 단계 2026년 7월 30일부터 신규 고객이 사용할 수 없게 되는 서비스 및 기능은 다음과 같다. - Amazon Bedrock Agents → Amazon Bedrock Agents Classic - Amazon Cognito Sync - Amazon Kendra - Amazon Q Business - AWS Directory Service – Simple AD - AWS IoT Device Defender – Detect - 2026년 8월 31일부터 신규 고객 접근 제한 - AWS Mainframe Modernization – Self-Managed Experience - AWS Management Console – myApplications - AWS Resource Groups – Group Lifecycle Events - AWS Service Catalog – Application Registry - AWS Systems Manager – Application Manager - SageMaker AI의 A2I, Clarify, Debugger, GeoSpatial, Ground Truth, Mechanical Turk, Model Monitor, Role Manager, Studio Lab ### 서비스 일몰(Sunset) 대상 - Amazon WorkSpaces – PCoIP - Amazon WorkSpaces – Pool - AWS Managed Services Advanced - AWS re:Post Private - Amazon SageMaker AI – Profiler ### 지원 종료 대상 2026년 6월 30일부로 다음 서비스의 지원이 종료됐다. - Amazon Chime SDK – Carrier Voice Focus - Amazon SageMaker AI – Ground Truth Plus ## 예정된 AWS 행사 - AWS Summits: - 2026년 하반기 각 지역에서 열리는 무료 클라우드·AI 행사다. - 최신 기술을 학습하고 커뮤니티와 교류할 수 있다. - AWS Community Days: - 커뮤니티가 직접 기획하고 운영하는 행사다. - 브라질에서는 AWS Community Day Belo Horizonte가 2026년 8월 22일 개최될 예정이다. - AWS Builder Center: - 개발자와 빌더가 솔루션을 공유하고 관련 콘텐츠 및 행사 정보를 확인할 수 있는 커뮤니티 공간이다. 사용 중인 AWS 서비스가 유지보수, 일몰 또는 지원 종료 대상인지 먼저 확인하고, 대체 서비스와 마이그레이션 일정을 미리 수립하는 것이 좋다. 신규 AI·인프라 프로젝트에서는 Claude Sonnet 5, CloudFormation Express, EKS 롤백, 로그 기반 CloudWatch 알람 등을 활용하면 개발 속도와 운영 안정성을 함께 높일 수 있다.

원문 읽기(새 탭에서 열림)
aws3분 읽기큐레이션 요약

Kubernetes 버전 롤백으로 Amazon EKS 클러스터를 안심하고 업그레이드하기 | Amazon Web Services

Amazon EKS가 Kubernetes 클러스터 업그레이드 후 7일 이내에 이전 마이너 버전으로 되돌릴 수 있는 버전 롤백 기능을 출시했습니다. 이는 업그레이드 실패 시 클러스터를 재구축하지 않고, 실제 운영에서 검증된 이전 버전으로 복구할 수 있게 해줍니다. 이를 통해 업그레이드에 대한 부담을 줄이고 보안 패치와 최신 버전 도입을 더욱 적극적으로 추진할 수 있습니다. ### 기존 Kubernetes 업그레이드의 한계 - 오픈소스 Kubernetes는 전통적으로 컨트롤 플레인 버전 롤백을 지원하지 않았습니다. - 업그레이드 후 문제가 발생하면 클러스터를 재구축하거나 장기간의 복구 작업을 진행해야 했습니다. - 조직들은 다음과 같은 보완책을 마련해야 했습니다. - 긴 사전 검증 및 bake 기간 - 단계적 업그레이드 그룹(stagger groups) - 자동 승인 절차 - 수개월에 걸친 업그레이드 일정 - 그 결과 보안 패치가 포함된 최신 Kubernetes 버전으로의 업그레이드를 미루고, 지원 종료나 연장 지원 기간에 임박하는 문제가 발생했습니다. ### Amazon EKS 버전 롤백 기능 - 업그레이드 후 **7일 이내**에 이전 Kubernetes 마이너 버전으로 되돌릴 수 있습니다. - 예를 들어 Kubernetes 1.34에서 1.35로 업그레이드한 뒤 문제가 발견되면 1.34로 복구할 수 있습니다. - 에뮬레이션된 버전이나 임시 상태가 아니라, 실제 운영에서 사용했던 검증된 이전 버전으로 복원합니다. - 한 번에 한 마이너 버전만 롤백할 수 있으며, 이는 EKS의 점진적 업그레이드 정책과 동일합니다. - 자체 관리 노드를 사용하는 클러스터와 AWS 관리형 노드를 사용하는 클러스터 모두 컨트롤 플레인 롤백을 지원합니다. ### 롤백 준비 상태 점검 - EKS는 클러스터 인사이트를 통해 롤백 가능 여부를 자동으로 평가합니다. - 다음과 같은 문제를 사전에 확인할 수 있습니다. - 노드와 컨트롤 플레인 간 버전 호환성 - 애드온 의존성 - 롤백을 방해할 수 있는 클러스터 구성 - 점검 결과를 확인한 뒤 롤백을 시작할 수 있습니다. - 긴급하게 진행해야 하는 경우 `--force` 옵션으로 준비 상태 검사를 우회할 수 있습니다. ### EKS Auto Mode의 노드 롤백 - EKS Auto Mode에서는 컨트롤 플레인과 관리형 노드를 함께 롤백해야 합니다. - 노드 롤백은 Pod Disruption Budget(PDB)을 준수하므로, 설정에 따라 완료까지 시간이 걸릴 수 있습니다. - 롤백이 지나치게 오래 걸리거나 전략을 바꾸고 싶을 때 사용할 수 있도록 취소 API가 제공됩니다. - 기본적으로 EKS는 롤백 중 PDB를 무시하지 않습니다. - 롤백을 빠르게 진행하려면 사용자가 직접 PDB를 수정하거나 제거해야 합니다. - 노드 롤백 기능은 EKS Auto Mode 클러스터에 제공됩니다. ### 롤백 과정과 운영 영향 - EKS 콘솔의 클러스터 설정 화면에서 롤백 가능 여부와 남은 롤백 기간을 확인할 수 있습니다. - 롤백 시작 전에 클러스터 인사이트를 검토해 노드 상태와 잠재적인 문제를 확인합니다. - 사례에서는 컨트롤 플레인 롤백에 약 20분이 걸렸으며, 이는 일반적인 업그레이드와 비슷한 수준입니다. - 롤백 중에도 클러스터는 계속 동작했습니다. - Auto Mode 노드는 PDB 설정에 따라 워크로드 중단을 최소화하면서 순차적으로 롤백됩니다. ### 제공 범위와 비용 - 상용 Amazon EKS가 제공되는 모든 AWS 리전에서 사용할 수 있습니다. - 추가 비용은 없으며, 기존 EKS 및 컴퓨팅 리소스 요금만 부과됩니다. - 표준 지원 또는 연장 지원 대상 Kubernetes 버전을 실행하는 클러스터가 지원됩니다. - 컨트롤 플레인 롤백은 모든 EKS 클러스터에서 사용할 수 있고, 노드 롤백은 EKS Auto Mode에서 지원됩니다. 운영 환경에서는 업그레이드 전에 롤백 가능 기간과 클러스터 인사이트를 확인하고, PDB와 애드온 호환성을 점검하는 것이 좋습니다. 특히 Auto Mode 사용자는 롤백 시간에 영향을 주는 PDB 설정과 취소 API 사용 방법을 미리 검토하면 안전한 복구 계획을 세울 수 있습니다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

AWS 주간 요약: Amazon Connect Customer를 위한 에이전틱 CX 디자이너, EC2 AMI 워터마크, MySQL을 위한 오픈 거버넌스 등 (2026년 6월 29일) | Amazon Web Services

AWS는 기업이 긴 개발 백로그를 기다리지 않고 AI 기반 고객 경험과 운영 자동화를 구축할 수 있도록 노코드 도구와 AI 보조 기능을 확대하고 있다. 이번 주의 핵심은 Amazon Connect Customer의 Agentic CX Designer와 다양한 서비스의 AI 에이전트·자동화 기능이다. 동시에 EC2 이미지 추적, MySQL 오픈 거버넌스, 자격증 갱신 제도 등 인프라 관리와 개발자 생태계 변화도 소개됐다. ## Amazon Connect Customer의 Agentic CX Designer - 비즈니스 담당자가 직접 AI 기반 고객 경험을 설계하고 배포할 수 있는 노코드 캔버스다. - 음성 및 디지털 채널에서 다음 두 가지 AI 방식을 하나의 관리된 흐름으로 결합한다. - **Agentic AI**: 상황을 판단하고 여러 단계를 수행하는 자율형 AI - **Deterministic AI**: 정해진 규칙과 절차에 따라 일관되게 동작하는 AI - 설계부터 테스트, 시뮬레이션, 운영 배포까지의 과정을 지원해 구축 기간을 수개월에서 수주로 단축하는 것을 목표로 한다. - 프리뷰로 제공되는 **Live Sync**는 사용자가 말하거나 입력하는 내용을 바탕으로 웹·모바일 화면을 실시간으로 변경한다. - 통화 중 고객이 별도 화면을 찾지 않고도 양식을 작성할 수 있다. - 상담 내용에 맞춰 적절한 상품 페이지를 자동으로 표시할 수 있다. - 고객 경험 설계자의 역할이 개발자 중심에서 비즈니스 사용자까지 확대될 수 있다는 점이 핵심이다. ## AWS Lambda MicroVMs - 각 사용자나 작업에 VM 수준의 격리를 제공하는 새로운 서버리스 컴퓨팅 프리미티브다. - Firecracker를 기반으로 하며 빠른 시작과 재개 속도를 제공한다. - 실행 상태를 최대 8시간 동안 일시 중지했다가 다시 재개할 수 있다. - 멀티테넌트 애플리케이션에서 사용자 생성 코드나 AI가 생성한 코드를 실행할 때 유용하다. - 별도의 가상화 인프라를 관리하지 않으면서도 속도, 격리, 상태 보존을 함께 확보하는 것이 목적이다. ## EC2 AMI Watermarks와 이미지 통제 - 프라이빗 AMI에 사용자 정의 식별자를 삽입할 수 있다. - 워터마크는 AMI 복사, 리전 이동, 계정 공유를 거쳐 파생된 AMI에도 자동으로 전달된다. - **Allowed AMIs** 및 **Declarative Policies**와 함께 사용하면 승인된 이미지로만 EC2 인스턴스를 실행하도록 제한할 수 있다. - 모든 AWS 리전에서 추가 비용 없이 제공된다. - 이미지의 출처와 계보를 추적하거나, 조직의 승인 정책을 강제하는 데 활용할 수 있다. ## Outposts 셀프서비스 수명주기 관리 - AWS 콘솔, CLI, API에서 Outposts 관련 작업을 직접 수행할 수 있다. - 지원 범위에는 다음이 포함된다. - 구성 - 견적 산출 - 주문 - 구독 관리 - 갱신 - 폐기 및 해제 - 새로운 견적 도구는 실시간 비용을 수초 내 계산한다. - 주문 전에 계정 및 리전의 제약 조건을 표시해 구성 오류와 주문 지연을 줄인다. ## Kafka·OpenSearch 운영을 돕는 AI 에이전트 - **Amazon MSK AI Agent Skills** - Kiro, Claude Code, Cursor 같은 AI 코딩 도우미에 Amazon MSK 운영 지식을 제공한다. - 문제 해결, 용량 산정, 구성, 모니터링을 안내한다. - 외부 Kafka 클러스터를 MSK Express로 이전하는 작업도 지원한다. - 전문 운영 지식이 필요한 작업을 개발자가 단계적으로 수행할 수 있게 한다. - **Amazon OpenSearch Service AI-assisted migrations** - 셀프 매니지드 Solr, Elasticsearch, OpenSearch를 OpenSearch Serverless 또는 Managed Clusters로 이전하도록 돕는다. - Kiro와 Claude Code를 활용한 에이전트 기반 마이그레이션 경험을 제공한다. - Solr 환경에서는 실시간 트래픽을 캡처하고 재생하는 기능도 추가됐다. - 이전 전후 동작을 검증하고 마이그레이션 위험을 줄이는 데 초점을 둔다. ## GuardDuty의 AI 기반 보안 조사 - 프리뷰 기능으로, 보안 탐지 결과와 계정 활동을 자동 분석한다. - 최근 90일간의 관련 활동과 주변 맥락을 지식 그래프 및 위협 인텔리전스와 함께 검토한다. - 실제 위협과 정상 활동을 구분해 보안팀의 조사 부담을 줄인다. - 각 조사 결과에 다음 정보를 제공한다. - 위협 여부에 대한 처분 평가 - 신뢰도 점수 - MITRE ATT&CK 분류 - 실행 가능한 대응 권고 - 수동 분석에 걸리는 시간을 줄이고, 몇 분 안에 우선순위가 높은 대응 방향을 제시하는 것이 목표다. ## MySQL 오픈 거버넌스 - Oracle은 MySQL 프로젝트에 외부 조직이 공식적으로 참여할 수 있는 커뮤니티 거버넌스 모델을 발표했다. - 새로운 Steering Committee에 Oracle 외부 인사를 위한 4석을 마련한다. - 공개 GitHub 활동을 통해 개발 과정의 투명성과 커뮤니티 참여를 강화한다. - AWS도 위원회 의석을 보유하며, MySQL 업스트림에 수정 사항을 기여해 온 사례와 이번 변화에 대한 지지를 밝혔다. - 기업 사용자는 특정 공급업체에만 의존하지 않고 프로젝트 방향성과 개발 과정에 더 직접적으로 참여할 가능성이 커진다. ## 자격증 갱신과 개발자 지원 - 일부 AWS Associate 및 Professional 자격증은 전체 시험을 다시 치르지 않고도 갱신할 수 있다. - AWS Skill Builder의 지정 교육과 실습 랩을 완료하면 자격증을 1년 추가로 유지할 수 있다. - 현재 오픈 베타로 제공되며, 대상 자격증은 올해 후반 더 확대될 예정이다. - 2026년 All Builders Welcome Grant는 AWS re:Invent 참가 패스, 항공료, 숙박을 지원한다. - 신청 마감일은 7월 14일이며, AWS Summit과 Community Day를 통해 오프라인 네트워킹과 학습 기회도 제공된다. 실무적으로는 비즈니스 팀이 고객 경험을 직접 설계해야 한다면 Agentic CX Designer를 검토하고, 멀티테넌트 코드 실행에는 Lambda MicroVMs, AMI 거버넌스에는 Watermarks와 Allowed AMIs를 함께 검토할 만하다. 운영 측면에서는 MSK·OpenSearch 마이그레이션과 GuardDuty 조사 기능을 활용해 전문 인력 의존도와 수동 분석 시간을 줄일 수 있다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

AWS 주간 요약: 뉴욕 서밋 결산, 하노이 로컬 존, Bedrock의 Grok 4.3, 가격 인하 등 (2026년 6월 22일) | Amazon Web Services

AWS는 뉴욕 서밋에서 장기적으로 가치를 축적하는 AI 에이전트를 중심으로 업무, 보안, 개발, 고객용 애플리케이션 전반의 기능을 확장했다. 동시에 하노이 Local Zone, Grok 4.3, S3 annotations, ECS 오토 스케일링 개선 등 인프라와 생성형 AI 관련 기능도 공개했다. S3 벡터 검색, GameLift 네트워크 대역폭, AWS Marketplace 서비스 등록 수수료 인하를 통해 비용 절감도 추진했다. ## 뉴욕 AWS 서밋: 장기적으로 가치를 만드는 에이전트 - **업무용 에이전트** - Amazon Quick에서 데스크톱 앱을 통해 다단계 자율 에이전트를 생성하고 실행할 수 있다. - 이메일, Slack, 캘린더, 작업을 하나의 우선순위 기반 피드로 통합한다. - 사용자가 설정한 개인화 규칙에 따라 업무를 정리한다. - **보안용 에이전트** - AWS Continuum은 코드 취약점 전 생명주기를 분석·검증·조치하는 AI 기반 보안 서비스다. - AWS Security Agent에 위협 모델링, 주요 Git 플랫폼용 PR 코드 스캔 및 수정 기능이 추가됐다. - Kiro, Claude Code 플러그인, MCP를 통한 IDE 통합도 지원한다. - **개발 및 현대화 에이전트** - Kiro는 네이티브 iOS 앱을 제공한다. - AWS DevOps Agent는 배포 전에 코드 변경 사항을 평가하는 릴리스 관리 기능을 추가했다. - AWS Transform은 기술 부채를 지속적으로 줄이는 자동 현대화를 지원한다. - **고객이 만드는 에이전트** - Amazon Bedrock AgentCore에 인프라·오케스트레이션용 GA 하네스가 추가됐다. - Web Search, Managed Knowledge Base, Guardrails 정책 통합을 제공한다. - AWS Context 서비스는 조직 데이터 간 관계를 매핑해 에이전트의 맥락 이해를 돕는다. ## 하노이 Local Zone과 데이터 주권 - 베트남 하노이에 `ap-southeast-1-han-1a` Local Zone이 추가됐다. - Amazon S3와 Amazon EBS Local Snapshots를 지원한다. - 데이터를 현지에 저장하고 백업할 수 있어 데이터 레지던시 요구사항을 충족하는 데 유리하다. - AWS Global View의 Regions and Zones 탭 또는 `ModifyAvailabilityZoneGroup` API로 활성화할 수 있다. ## AWS Blocks와 개발 환경 단순화 - AWS Blocks는 애플리케이션 개발자를 위한 오픈 소스 TypeScript 프레임워크다. - AWS 계정 없이도 Postgres, 인증, 실시간 메시징을 포함한 로컬 실행 환경을 제공한다. - 배포 시 동일한 코드를 변경 없이 AWS 프로덕션 서비스에서 실행할 수 있다. - 필요할 때 AWS CDK로 전환해 클라우드 리소스를 직접 구성할 수 있다. ## Bedrock, S3, 에이전트 기능 확장 - **Grok 4.3** - xAI의 Grok 4.3을 Amazon Bedrock에서 사용할 수 있다. - 추론, 에이전트 워크플로, 엔터프라이즈 애플리케이션을 지원한다. - 도구 호출, 구조화된 출력, 응답 스트리밍을 제공한다. - **S3 annotations** - S3 객체에 최대 1GB의 풍부하고 변경 가능한 컨텍스트를 직접 연결할 수 있다. - 해당 컨텍스트는 조회 가능하며, AI 에이전트가 데이터를 탐색·이해·처리하는 데 활용된다. - 별도의 메타데이터 시스템을 유지하지 않고도 대규모 AI 및 자동화 워크플로를 구성할 수 있다. - **Strands Agents** - 오픈 소스 에이전트 개발 도구인 Strands에 컨텍스트 관리 기능이 강화됐다. - Strands Shell은 격리된 실행 환경을 제공한다. - Strands Evals에는 장애 주입 테스트와 레드팀 테스트 기능이 추가됐다. ## 성능과 운영 기능 개선 - **ECS 서비스 오토 스케일링** - 20초 단위 고해상도 지표와 지표 게시 최적화를 지원한다. - 테스트에서 스케일 아웃 트리거 시간이 363초에서 86초로 76% 단축됐다. - 확장 및 신규 태스크 프로비저닝까지의 전체 시간은 386초에서 109초로 72% 줄었다. - **EC2 G7** - NVIDIA RTX PRO 4500 Blackwell Server Edition GPU와 6세대 Intel Xeon 프로세서를 탑재한다. - G6 대비 AI 추론 성능은 최대 4.6배, 그래픽 성능은 최대 2.1배 향상됐다. - **Management Console Private Access** - 인터넷 연결 없이 VPC에서 AWS Management Console에 접근할 수 있다. - 에어갭 환경에서도 엄격한 네트워크 보안 정책을 유지하며 인프라를 관리할 수 있다. ## 보안 및 마켓플레이스 - Palo Alto Networks Advanced DNS Security를 Route 53 Resolver DNS Firewall에 직접 적용할 수 있다. - 별도 방화벽을 배포하거나 VPC 구성을 변경하지 않고 DNS 위협 방어 기능을 사용할 수 있다. - AWS Marketplace Storefront가 정식 출시되어 파트너가 자체 브랜드 카탈로그를 웹사이트나 애플리케이션에 구축할 수 있다. - 고객은 AWS Marketplace를 통해 파트너 솔루션을 검색하고 구매할 수 있다. ## 가격 인하 - **Amazon S3 Vectors** - 대규모 벡터 인덱스의 유사도 검색 쿼리 요금을 최대 80% 인하했다. - 기존 애플리케이션 변경 없이 자동 적용된다. - AI, RAG, 시맨틱 검색 비용 절감에 직접적인 효과가 있다. - **Amazon GameLift Servers** - 6세대 이상 인스턴스의 AWS 내 네트워크 송수신 대역폭을 무료화했다. - On-Demand와 Spot 모두 적용되며, 사용자는 인스턴스 시간만 지불한다. - **AWS Marketplace 전문 서비스** - 등록 수수료를 기존 2.5%에서 0.5%로 낮췄다. - 컨설팅 업체, 시스템 통합 사업자, 관리형 서비스 제공업체의 거래 비용을 줄인다. 이번 발표의 방향은 AI 에이전트를 실제 업무와 운영에 통합하는 동시에, 데이터 주권·보안·성능·비용 문제를 함께 개선하는 것이다. 에이전트 기반 애플리케이션을 구축하려는 팀은 Bedrock AgentCore와 S3 annotations를 검토하고, 대규모 검색·게임·서비스 운영 환경은 이번 가격 및 성능 개선의 적용 여부를 확인하는 것이 좋다.

원문 읽기(새 탭에서 열림)
aws3분 읽기큐레이션 요약

NVIDIA RTX PRO 4500 Blackwell 서버 에디션 GPU로 가속되는 Amazon EC2 G7 인스턴스 발표 | Amazon Web Services

Amazon EC2 G7은 NVIDIA RTX PRO 4500 Blackwell Server Edition GPU와 6세대 Intel Xeon 프로세서를 결합한 GPU 인스턴스다. G6 대비 AI 추론 성능은 최대 4.6배, 그래픽 성능은 최대 2.1배 향상됐으며, 네트워크·스토리지·영상 처리 성능도 크게 개선됐다. AI 추론, 그래픽 렌더링, 영상 변환, VDI, 공간 컴퓨팅, 데이터 분석 등에 적합하다. ## NVIDIA Blackwell GPU 기반 성능 향상 - AWS 최초로 NVIDIA RTX PRO 4500 Blackwell Server Edition GPU를 지원한다. - GPU당 32GB 메모리를 제공하며, 인스턴스당 최대 8개 GPU와 총 256GB GPU 메모리를 구성할 수 있다. - G6 대비 GPU 메모리 용량은 1.33배, 메모리 대역폭은 2.45배 향상됐다. - 5세대 Tensor Core와 4세대 RT Core를 탑재해 AI 추론과 실시간 그래픽 처리를 가속한다. - G6 대비 AI 추론 성능은 최대 4.6배, 그래픽 성능은 최대 2.1배 높다. ## 네트워크와 로컬 스토리지 개선 - EFA(Elastic Fabric Adapter)를 지원하는 최대 700Gbps 네트워크 대역폭을 제공한다. - G6 대비 네트워크 처리량이 7배 증가해 다중 GPU·다중 노드 AI 및 분석 작업에 유리하다. - 최대 7.6TB의 로컬 NVMe SSD를 사용할 수 있다. - 대규모 모델과 데이터셋을 컴퓨팅 자원 가까이에 저장해 데이터 전송 지연과 처리 오버헤드를 줄인다. - 다중 GPU 환경에서는 NVIDIA GPUDirect P2P를, GPU와 네트워크·스토리지 간 통신에는 GPUDirect RDMA와 EFA를 지원한다. ## 영상 인코딩·디코딩 성능 - 9세대 NVENC와 6세대 NVDEC 엔진을 탑재했다. - 고해상도 영상 작업에 필요한 4:2:2 인코딩과 디코딩을 지원한다. - 동시 처리 가능한 영상 스트림 수가 G6 대비 1.5배 증가했다. - 영상 트랜스코딩, 스트리밍, 미디어 분석과 같은 작업에 적합하다. ## 인스턴스 구성 - 총 7개 크기로 제공된다. - 최대 사양: - NVIDIA RTX PRO 4500 GPU 8개 - GPU 메모리 256GB - vCPU 192개 - 시스템 메모리 768GiB - 네트워크 대역폭 700Gbps - 로컬 NVMe SSD 7.6TB - 12xlarge, 24xlarge, 48xlarge 크기는 Dedicated Instances도 지원한다. ## 지원 소프트웨어와 운영 환경 - AWS Deep Learning AMI와 NVIDIA Workstation AMI를 통해 사전 구성된 GPU 드라이버를 사용할 수 있다. - Amazon EKS에서 사용하려면 NVIDIA 드라이버 R595와 EKS 자동화 기능을 이용해 AMI를 구성해야 한다. - Amazon Linux, Ubuntu, RHEL, Windows Server를 지원한다. - DirectX, Vulkan, OpenGL 등 주요 그래픽 라이브러리와 호환된다. - Amazon EMR on EKS에서 GPU 가속 데이터 분석에도 활용할 수 있다. ## 제공 지역과 구매 방식 - 발표 시점에는 미국 동부 오하이오와 미국 서부 오리건 리전에서 사용할 수 있다. - 향후 리전 확대 여부는 AWS Capabilities by Region 페이지에서 확인할 수 있다. - On-Demand, Savings Plans, Spot Instances 방식으로 구매 가능하다. - 자세한 요금은 Amazon EC2 요금 페이지에서 확인해야 한다. G7은 GPU 메모리와 네트워크 대역폭이 중요한 AI 추론, 대규모 그래픽 처리, 영상 처리 및 분산 분석 작업에 특히 적합하다. 기존 G6에서 GPU·네트워크 병목을 겪고 있다면, 사용 리전과 실제 워크로드별 비용 대비 성능을 비교한 뒤 G7으로 이전하는 것이 좋다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

AWS 주간 정리: AWS의 Claude Opus 4.8, Kiro Powers를 지원하는 Aurora MySQL 등 (2026년 6월 1일) | Amazon Web Services

AI와 클라우드 서비스의 결합이 소프트웨어 개발과 AWS 고객 지원 방식을 빠르게 바꾸고 있다는 내용이다. 특히 Anthropic의 Claude Opus 4.8이 Amazon Bedrock과 Claude Platform on AWS에서 제공되면서 장시간 자율 작업과 에이전트형 코딩이 한층 강화됐다. AWS는 이와 함께 복원력 관리, 에이전트용 검색, 마이그레이션 분석, 자연어 기반 Aurora 운영 등 AI 중심 기능을 대거 공개했다. ## AI 기반 개발 방식의 확산 - AI-Driven Development Lifecycle(AI-DLC) 워크숍에서 17개 팀이 이틀 동안 약 20개의 사용 사례를 구현했다. - Claude Code on Amazon Bedrock 같은 도구를 활용하면 개발 작업의 속도가 크게 향상된다. - 기존의 세분화된 소프트웨어 개발 직무가 AI를 활용하는 소규모 팀 중심으로 재편되고 있다. - AWS의 솔루션 아키텍트와 기술 담당자도 설계 문서를 전달하는 방식에서 벗어나, 고객과 실시간으로 함께 구축하는 방식으로 협업하고 있다. ## AWS의 Claude Opus 4.8 지원 - Anthropic의 최신 범용 모델인 Claude Opus 4.8을 다음 두 경로로 사용할 수 있다. - **Amazon Bedrock**: Guardrails, Knowledge Bases, 데이터 레지던시 등 AWS 관리 기능 제공 - **Claude Platform on AWS**: Anthropic 네이티브 API와 AWS 청구 체계 통합 - 에이전트형 코딩, 지식 노동, 장시간 자율 작업에 최적화됐다. - 긴 세션에서 문맥을 유지하고, 오류를 복구하며, 방대한 문서의 정보를 종합할 수 있다. - 코드베이스를 엔지니어처럼 분석하고 수정 전에 계획을 수립하는 코딩 워크플로를 지원한다. ## 차세대 AWS Resilience Hub - SRE와 개발자가 조직 전체 애플리케이션의 복원력 기준을 정의하고 평가하는 통합 프레임워크를 제공한다. - 복원력 정책을 모듈식으로 구성할 수 있다. - 서비스 수준 목표(SLO) - 멀티 AZ·멀티 리전 재해 복구 - 데이터 복구 기준 - 비즈니스 관점의 애플리케이션 모델링을 지원한다. - 생성형 AI가 Well-Architected Framework와 Resilience Analysis Framework를 기준으로 복원력을 평가한다. - DNS 쿼리 로그를 분석해 애플리케이션 의존성을 자동으로 탐색한다. - AWS Organizations와 연동하면 위임된 관리자 계정 하나에서 조직 전체의 복원력을 관리할 수 있다. ## 에이전트형 AI를 위한 OpenSearch Serverless - Amazon OpenSearch Serverless가 검색 엔진과 벡터 엔진을 결합한 에이전트 애플리케이션용 관리형 서비스로 확장됐다. - 요청량이 0에서 초당 수천 건까지 자동 확장되며, 이전 세대보다 약 20배 빠르다. - 피크 용량을 기준으로 클러스터를 프로비저닝하는 방식보다 최대 60%의 비용 절감이 가능하다. - GPU 가속과 `SEARCH`, `VECTORSEARCH` 컬렉션 유형을 새로 지원한다. - OpenSearch Agent Skills를 통해 Vercel, Kiro, Claude Code, Cursor와 통합할 수 있다. ## AWS Transform의 마이그레이션·현대화 분석 - AWS 이전 전에 비즈니스 케이스와 총소유비용(TCO)을 검토할 수 있는 기능이 추가됐다. - 다음과 같은 다양한 데이터 소스를 수집할 수 있다. - RVTools 내보내기 파일 - CMDB 데이터 - AWS Transform 검색 도구 - 서드파티 검색 도구 - 리전, 사용률, 서비스 매핑을 바꿔 가며 가상 시나리오를 실행할 수 있다. - EC2, FSx, S3, EC2의 SQL Server, 가상 데스크톱 환경을 분석한다. - **Agentic Readiness Analysis(ARA)**와 **Modernization Analysis(MODA)**가 코드 저장소를 약 5~30분 안에 분석한다. - 결과에는 심각도, 파일 단위 근거, AWS 서비스에 매핑된 개선 지침이 포함된다. ## Kiro Powers를 활용한 Aurora MySQL 운영 - Aurora MySQL이 Kiro Powers와 통합되어 사전 검증된 MCP 서버, steering 파일, hooks를 활용할 수 있다. - 개발자는 자연어로 다음 작업을 수행할 수 있다. - 데이터 플레인: SQL 쿼리, 스키마 관리 - 컨트롤 플레인: 클러스터 관리 - Aurora Serverless 확장, RDS에서 Aurora로의 마이그레이션, 복제 구성 등에 대한 동적 안내를 제공한다. - 에이전트가 생성한 API 호출, SQL, 설정을 사용자가 검토한 뒤 실행할 수 있다. - Kiro IDE나 웹페이지에서 원클릭 설치가 가능하다. ## WorkSpaces Applications의 Windows Desktop 지원 - Amazon WorkSpaces Applications에서 자체 Windows Desktop 라이선스를 가져오는 BYOL 방식을 지원한다. - OS 라이선스 비용 없이 컴퓨팅 및 스트리밍 인프라 비용만 부담할 수 있다. - 적격 Microsoft 365 Apps for enterprise도 지원한다. - 로컬 PC와 원격 환경에서 동일한 단축키, 작업 흐름, 탐색 경험을 제공한다. ## 추가 AWS 소식 - 2026년 5월 AWS Heroes 신규 선정자를 소개했다. - Vercel 대시보드나 v0에서 Aurora PostgreSQL, DynamoDB, Aurora DSQL을 직접 프로비저닝하는 AWS 데이터베이스 통합이 공개됐다. - 해당 기술 조합을 활용하는 H0 해커톤에서 총 16만 달러의 상금을 제공한다. - AWS GovCloud(US) 고객의 기술 지원 요청이 미국 내 미국 시민 엔지니어에게 24시간 자동 라우팅된다. ## 실용적인 결론 AWS 환경에서 AI 에이전트를 도입하려면 Claude Opus 4.8을 Bedrock의 보안·거버넌스 기능과 함께 검토하고, OpenSearch Serverless를 검색·벡터 검색 계층으로 활용할 수 있다. 또한 Aurora MySQL 운영 자동화, AWS Transform의 사전 마이그레이션 분석, Resilience Hub의 조직 단위 복원력 평가를 결합하면 개발 속도뿐 아니라 운영 안정성과 비용 예측 가능성도 높일 수 있다.

원문 읽기(새 탭에서 열림)
aws3분 읽기큐레이션 요약

새로운 AWS 히어로를 만나보세요 – 2026년 5월 | Amazon Web Services

2026년 5월 AWS Heroes로 네 명의 커뮤니티 리더가 새롭게 선정되었습니다. 이들은 AI·서버리스·클라우드 아키텍처 지식을 공유하고, 사용자 그룹과 커뮤니티 행사를 운영하며, 교육과 멘토링으로 AWS 생태계의 성장을 돕고 있습니다. 특히 AWS re:Invent 도구 개발, 라틴아메리카 최대 규모 커뮤니티 운영, AI/ML 인증 기여 등 각자의 전문성을 바탕으로 활동해 왔습니다. ## AWS Heroes 선정의 의미 - AWS Heroes는 기술 전문성뿐 아니라 커뮤니티에 대한 기여와 지식 공유를 인정받은 리더들입니다. - 선정된 인물들은 블로그, 팟캐스트, 컨퍼런스, 사용자 그룹, 교육 행사 등을 통해 다른 개발자와 클라우드 실무자를 지원해 왔습니다. - 이번에는 이탈리아, 캐나다, 아르헨티나에서 AI, 서버리스, 클라우드 아키텍처 분야의 리더들이 선정되었습니다. ## Damiano Giorgi: AI 기반 re:Invent 세션 추천 도구 - 이탈리아 파비아 출신의 **Artificial Intelligence Hero**입니다. - 온프레미스 시스템 엔지니어에서 AWS 클라우드 솔루션 아키텍트로 전환했으며, 현재 AI의 발전과 활용에 집중하고 있습니다. - AWS User Group Pavia와 AWS User Group Milan의 운영을 돕고 있습니다. - 개인 블로그 **“Bass and Bytes”**를 통해 기술 콘텐츠를 공유합니다. - Amazon Bedrock과 Amazon Nova를 활용해 관심사에 맞는 AWS re:Invent 세션을 찾도록 돕는 **“Unofficial post:Invent Session Suggester”**를 개발했습니다. - AWS Summit Milan을 비롯해 이탈리아, 아드리아 지역, 그리스, 네덜란드 등 유럽의 다양한 컨퍼런스에서 발표하고 있습니다. ## Darryl Ruggles: 서버리스와 AI/ML 아키텍처 전파 - 캐나다 오타와 출신의 **Serverless Hero**입니다. - 소프트웨어 개발자로 오랜 기간 일한 뒤 AWS 애플리케이션 및 AI/ML 아키텍처 분야로 전문성을 확장했습니다. - 서버리스, 컨테이너, AI/ML, FinOps를 주제로 블로그, LinkedIn, 공개 프로젝트에서 지식을 공유합니다. - **“Believe In Serverless”**를 포함한 여러 온라인 AWS 커뮤니티에서 활발히 활동합니다. - 온라인과 오프라인 행사를 가리지 않고 다른 개발자들과 교류하며 서버리스 기술의 실제 활용을 돕고 있습니다. ## Ricardo Daniel Ceci: 라틴아메리카 클라우드 커뮤니티 확장 - 아르헨티나 부에노스아이레스 출신의 **Artificial Intelligence Hero**입니다. - 약 2,400명의 회원을 보유한 아르헨티나 최대 AWS 커뮤니티인 **AWS User Group Buenos Aires**를 이끌고 있습니다. - **AWS Community Day Argentina**의 수석 조직자로 활동했습니다. - 2025년 **LATAM AWS Community Leader of the Year**로 선정되었습니다. - 라틴아메리카의 클라우드 전문가, AWS Heroes, 개발자 애드보킷과 대화하는 팟캐스트를 운영합니다. - 15년 이상의 클라우드 및 웹 개발 경험을 바탕으로 스페인어권 개발자들이 클라우드와 AI에 쉽게 접근하도록 지원하고 있습니다. ## Matias Kreder: AWS 인증과 머신러닝 커뮤니티 기여 - 부에노스아이레스 출신의 **Artificial Intelligence Hero**입니다. - AWS 인증 시험의 Subject Matter Expert(SME)로 참여했으며, **AWS Certified AI Practitioner**를 포함한 여러 AI/ML 인증 개발에 기여했습니다. - AWS DeepRacer에서 세 차례 결승 진출자로 선정된 경험을 계기로 커뮤니티 활동을 시작했습니다. - 이후 지역 내 DeepRacer 대회와 머신러닝 발표·행사를 조직했습니다. - AWS User Group Buenos Aires의 리더로서 2025년 AWS Community Day Argentina를 조직했습니다. - 라틴아메리카 전역의 커뮤니티 행사에서 AI, 머신러닝, AWS 관련 주제로 발표하고 있습니다. ## 실용적인 시사점 - AWS 기술을 학습할 때 공식 문서뿐 아니라 사용자 그룹, 커뮤니티 행사, 팟캐스트, 공개 프로젝트를 함께 활용하면 실무 관점을 얻을 수 있습니다. - Amazon Bedrock·Nova 같은 생성형 AI 서비스를 실제 개발 도구에 적용한 사례는 AWS 서비스 학습과 프로토타이핑에 참고할 만합니다. - 관심 지역의 AWS Heroes나 사용자 그룹에 참여하면 발표, 멘토링, 자격증 준비, 네트워킹 기회를 얻을 수 있습니다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

AWS 주간 요약: 이스탄불의 AWS 로컬 영역, 오픈 소스 ExtendDB, Kiro Web 등 (2026년 5월 25일) | Amazon Web Services

AWS는 이번 주 지역 인프라 확장, 보안·AI 개발 편의성 강화, 오픈소스 생태계 확대에 집중했다. 특히 튀르키예 이스탄불 Local Zone은 데이터 주권과 낮은 지연 시간이 중요한 기업에 새로운 아키텍처 선택지를 제공하며, SageMaker의 OpenAI 호환 API와 ExtendDB는 기존 애플리케이션의 AWS 이전 및 데이터 계층 이식성을 높인다. 또한 Kiro Web, Secrets Manager Agent 개선, SDK 재시도 정책 변경 등 개발·운영 효율을 높이는 업데이트도 소개됐다. ## 이스탄불 AWS Local Zone 개설 - AWS가 튀르키예 이스탄불에 새로운 Local Zone을 개설했다. - AWS 리전의 인프라를 대도시와 사용자 가까이에 배치해 다음을 지원한다. - 단일 자릿수 밀리초 수준의 지연 시간 - 특정 국가 내 데이터 저장·처리 - 금융, 정부, 통신, 의료 분야의 데이터 레지던시 및 규정 준수 - 튀르키예 기업은 데이터를 국경 안에 저장하고 백업하면서, 지연 시간에 민감한 워크로드를 이스탄불에서 실행할 수 있다. - 이스탄불 Local Zone은 AWS 리전과 연결되므로, 자체 데이터센터를 운영하지 않고도 Local Zone과 리전을 결합한 하이브리드 애플리케이션을 구성할 수 있다. - Local Zone은 하드웨어, 전력, 네트워크, 운영 체계 측면에서 높은 수준의 인프라 투자가 필요한 서비스다. ## 보안 및 운영 업데이트 - **AWS Security Hub Extended** - 통합 가능한 파트너 보안 솔루션이 21개로 확대됐다. - 엔드포인트 보호, CSPM, 위협 인텔리전스 등 9개 보안 영역을 다룬다. - AWS 및 서드파티 도구의 보안 탐지 결과를 Security Hub에서 통합·우선순위화할 수 있다. - 별도 커스텀 통합을 줄여 엔터프라이즈 보안 운영을 단순화한다. - **Secrets Manager Agent 개선** - 애플리케이션 시작 시 시크릿을 미리 가져오는 pre-fetch 기능이 추가됐다. - 요청 시 시크릿을 조회하면서 발생하던 콜드 스타트와 지연 시간을 줄일 수 있다. - IAM 역할을 맡아 시크릿을 조회할 수 있어, 서로 다른 권한 경계를 가진 워크로드 간 에이전트 공유가 쉬워졌다. - **AWS SDK 및 CLI 재시도 동작 변경** - 일시적 오류와 API throttling에 더 효과적으로 대응하도록 기본 재시도 로직이 개선됐다. - 더 지능적인 백오프 전략이 적용된다. - 별도 설정 변경 없이 프로덕션 애플리케이션의 복원력을 높일 수 있다. ## AI 개발 및 모델 이전 편의성 - **SageMaker AI의 OpenAI 호환 API** - SageMaker 추론 엔드포인트를 OpenAI API와 호환되는 방식으로 호출할 수 있다. - 기존 OpenAI용 SDK나 애플리케이션 코드를 크게 수정하지 않고 SageMaker로 전환할 수 있다. - 애플리케이션에서 엔드포인트 주소만 변경해 여러 모델 제공자나 AWS 인프라를 활용할 수 있다. - OpenAI 기반 프로토타입을 비용과 확장성을 고려한 SageMaker 환경으로 이전하는 장벽을 낮춘다. - **Amazon Bedrock 프롬프트 최적화 및 마이그레이션 도구** - 프롬프트를 자동으로 조정해 모델 성능을 개선한다. - 서로 다른 파운데이션 모델 사이에서 프롬프트를 이전하는 작업을 지원한다. - 프로덕션 AI 서비스의 프롬프트 품질을 반복적으로 개선하는 데 유용하다. - **Kiro Web** - AWS의 AI 기반 개발 환경 Kiro를 웹 브라우저에서 사용할 수 있게 됐다. - 데스크톱 IDE 설치 없이 스펙 기반 개발, AI 채팅, 에이전트 기능을 이용할 수 있다. - 다른 컴퓨터에서 빠르게 검토하거나 프로토타입을 제작하고, 팀에 Kiro 워크플로를 소개하기 쉬워졌다. ## ExtendDB와 데이터 계층의 이식성 - AWS가 **ExtendDB**를 오픈소스로 공개했다. - DynamoDB API와 데이터 모델을 사용하면서, 실제 저장소는 다른 백엔드 시스템으로 구성할 수 있는 어댑터다. - 주요 활용 사례는 다음과 같다. - 로컬 개발 및 테스트 환경에서 실제 AWS 연결 없이 DynamoDB API 사용 - 저장소 계층을 직접 제어해야 하는 환경 - DynamoDB 호환 의미론을 유지하면서 특정 백엔드에 종속되지 않는 구조 - 데이터 접근 계층의 이식성을 높이고, 개발·테스트 환경 구축 비용을 줄이는 데 도움이 된다. ## 서버리스 로컬 개발 개선 - AWS SAM CLI가 CloudFormation Language Extensions를 로컬에서 지원한다. - 로컬 개발 및 테스트 과정에서 다음과 같은 CloudFormation 기능을 사용할 수 있다. - 트랜스폼 - 동적 참조 - 기타 CloudFormation 언어 확장 기능 - 로컬 환경과 실제 배포 환경 사이의 기능 차이를 줄인다. - SAM 기반 서버리스 애플리케이션에서 로컬 테스트로 재현하기 어려웠던 엣지 케이스를 더 안정적으로 검증할 수 있다. ## 컨테이너 이미지 및 생태계 변경 - Amazon ECR Public에서 Bitnami 컨테이너 이미지가 제거될 예정이다. - ECR Public에서 Bitnami 이미지를 가져오는 워크로드는 영향을 받을 수 있다. - Bitnami 자체 레지스트리에서는 이미지가 계속 제공된다. - 운영 중인 이미지 참조를 Bitnami 레지스트리로 변경하고, 제거 일정과 마이그레이션 절차를 확인해야 한다. ## 예정된 AWS 행사 - AWS Summit Amsterdam: 5월 27일 개최 - AWS Summit Bangkok: 5월 28일 개최 - AWS Summit Milan: 5월 28일 개최 예정 - 클라우드·AI 세션, 실습, 네트워킹 등을 제공하며 유럽과 동남아시아 개발자 및 고객을 대상으로 한다. 실무적으로는 ECR Public의 Bitnami 이미지 의존성을 먼저 점검하고, OpenAI 호환 SageMaker API와 Secrets Manager Agent pre-fetch를 기존 서비스에 적용할 수 있는지 검토하는 것이 좋다. 튀르키예에서 서비스를 운영하거나 데이터 레지던시가 중요한 경우에는 이스탄불 Local Zone을 활용한 리전-Local Zone 아키텍처도 고려할 만하다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

AWS MCP 서버가 정식 출시되었습니다 | Amazon Web Services

AWS MCP Server는 AI 에이전트가 기존 IAM 자격 증명을 사용해 AWS 서비스에 안전하게 접근하도록 해 주는 관리형 원격 MCP 서버다. 최신 AWS 문서 검색, 15,000개 이상의 API 호출, 샌드박스 스크립트 실행을 제공해 에이전트가 오래된 학습 데이터나 과도한 권한 정책에 의존하는 문제를 줄인다. 특히 IAM 기반 권한 통제, CloudWatch·CloudTrail 감사, AWS 서비스별 Skills를 통해 프로덕션 환경에 적합한 AWS 자동화를 지원한다. ## AI 에이전트가 AWS에서 겪는 문제 - 모델의 학습 데이터가 오래되면 최신 서비스와 기능을 알지 못한다. - 예를 들어 2025년에 출시된 Amazon S3 Vectors를 학습하지 못한 모델은 S3에 임베딩을 저장하는 일반적인 방법만 제시할 수 있다. - 인프라를 구성할 때 AWS CDK나 CloudFormation보다 AWS CLI 명령을 우선적으로 생성하는 경향이 있다. - 필요 이상으로 광범위한 IAM 정책을 만들어 보안 위험을 키울 수 있다. - 데모 수준에서는 동작하더라도 최신 정보, 최소 권한, 운영 표준을 반영하지 못해 프로덕션 배포에는 부적합할 수 있다. ## AWS MCP Server의 핵심 도구 - `call_aws` - 기존 IAM 자격 증명을 사용해 15,000개 이상의 AWS API 작업을 실행한다. - 새 AWS API가 출시되면 며칠 내에 지원될 예정이다. - `search_documentation` - 실행 시점에 최신 AWS 공식 문서와 모범 사례를 검색한다. - `read_documentation` - 검색된 문서의 구체적인 내용을 읽어 에이전트가 최신 정보를 바탕으로 답변하도록 한다. - 이 도구들은 개별 AWS 서비스를 수천 개의 도구로 노출하지 않고 소수의 고정된 인터페이스로 제공해 모델 컨텍스트 사용량과 환각을 줄인다. ## GA 버전의 보안·효율성 개선 - IAM 컨텍스트 키를 지원해 별도의 MCP 서버용 IAM 권한 없이 표준 IAM 정책으로 세밀한 접근 제어를 설정할 수 있다. - 문서 검색은 인증 없이 사용할 수 있다. - 상호작용당 필요한 토큰 수를 줄여 복잡한 다단계 작업의 비용과 컨텍스트 부담을 낮췄다. - 에이전트 권한은 IAM 정책이나 SCP(Service Control Policy)로 제한할 수 있다. - 예를 들어 사용자는 리소스를 변경할 수 있지만 MCP 서버는 읽기 전용 작업만 수행하도록 분리할 수 있다. - `AWS-MCP` 네임스페이스의 CloudWatch 지표로 에이전트 호출을 사람의 직접 호출과 구분해 관찰할 수 있다. - CloudTrail은 실제 AWS API 호출에 대한 전체 감사 기록을 제공한다. ## 샌드박스 기반 `run_script` - 에이전트가 짧은 Python 스크립트를 작성해 AWS 서버 측 샌드박스에서 실행할 수 있다. - 샌드박스는 IAM 권한을 상속하지만 네트워크 접근과 로컬 파일 시스템·셸 접근은 차단된다. - 여러 AWS API를 순차적으로 호출하고 결과를 필터링·계산하는 작업을 한 번의 왕복으로 처리할 수 있다. - 그 결과 API 호출 지연과 모델 컨텍스트 사용량을 줄일 수 있다. - 로컬 환경 전체에 대한 접근 권한을 주지 않고도 데이터 처리 능력을 제공한다. ## Agent SOP에서 Skills로의 전환 - Skills는 에이전트가 자주 실수하는 작업에 대해 AWS 서비스 팀이 관리하는 검증된 지침과 모범 사례를 제공한다. - 에이전트가 더 적은 토큰으로 빠르고 일관되게 작업하도록 돕는다. - AWS 서비스별 지침을 별도 도구로 무분별하게 늘리지 않고 큐레이션된 지식으로 제공한다. - 짧고 예측 가능한 도구 목록을 유지해 환각을 줄이고 에이전트의 작업 집중도를 높인다. ## 최신 문서 검색을 통한 실제 효과 - 모델만 사용하면 Amazon S3 Vectors가 학습 데이터 이후에 출시되었기 때문에 해당 기능을 제안하지 못한다. - AWS MCP Server를 연결하면 `search_documentation`이 최신 AWS 문서를 조회한다. - 동일한 질문에 대해 Amazon S3 Vectors가 임베딩 저장을 위한 전용 서비스라는 정확한 답변을 얻을 수 있다. - 즉, 모델 자체를 재학습하지 않고도 실행 시점의 AWS 지식으로 최신 서비스와 API를 활용할 수 있다. ## 인증과 클라이언트 연동 - AWS MCP Server는 IAM과 IAM SigV4 인증을 사용한다. - MCP 클라이언트가 OAuth 2.1만 지원하는 경우 오픈 소스 `mcp-proxy-for-aws` 프록시를 사용해 로컬 AWS 자격 증명과 MCP를 연결할 수 있다. - 예시 설정은 Claude Code에서 다음과 같이 등록한다. ```bash claude mcp add-json aws-mcp --scope user \ '{"command":"uvx","args":["mcp-proxy-for-aws@latest","https://aws-mcp.us-east-1.api.aws/mcp","--metadata","AWS_REGION=us-west-2"]}' ``` - `--scope user`는 노트북의 모든 프로젝트에서 서버를 사용할 수 있게 한다. - 엔드포인트는 미국 동부 또는 유럽 리전에 위치하지만, API 호출 자체는 모든 AWS 리전에 수행할 수 있다. - Claude Code, Kiro, Cursor, Codex 등 MCP 호환 클라이언트에서 사용할 수 있다. ## 요금과 제공 리전 - AWS MCP Server 자체에는 추가 요금이 없다. - 사용자가 부담하는 비용은 생성한 AWS 리소스 비용과 해당 데이터 전송 비용이다. - 서비스 엔드포인트는 현재 미국 동부(버지니아 북부)와 유럽(프랑크푸르트) 리전에서 제공된다. 에이전트에 AWS 접근 권한을 부여할 때는 관리자 권한 대신 읽기 전용 또는 작업별 최소 권한 IAM 정책부터 적용하는 것이 좋다. 최신 문서 검색과 `run_script`를 활용하면 에이전트의 정확성과 효율성을 높이면서도 로컬 시스템과 AWS 리소스에 대한 접근 범위를 분리할 수 있다.

원문 읽기(새 탭에서 열림)