amazon-bedrock

39 개의 포스트

aws4분 읽기큐레이션 요약

AWS 주간 요약: 이스탄불의 AWS 로컬 영역, 오픈 소스 ExtendDB, Kiro Web 등 (2026년 5월 25일) | Amazon Web Services

AWS는 이번 주 지역 인프라 확장, 보안·AI 개발 편의성 강화, 오픈소스 생태계 확대에 집중했다. 특히 튀르키예 이스탄불 Local Zone은 데이터 주권과 낮은 지연 시간이 중요한 기업에 새로운 아키텍처 선택지를 제공하며, SageMaker의 OpenAI 호환 API와 ExtendDB는 기존 애플리케이션의 AWS 이전 및 데이터 계층 이식성을 높인다. 또한 Kiro Web, Secrets Manager Agent 개선, SDK 재시도 정책 변경 등 개발·운영 효율을 높이는 업데이트도 소개됐다. ## 이스탄불 AWS Local Zone 개설 - AWS가 튀르키예 이스탄불에 새로운 Local Zone을 개설했다. - AWS 리전의 인프라를 대도시와 사용자 가까이에 배치해 다음을 지원한다. - 단일 자릿수 밀리초 수준의 지연 시간 - 특정 국가 내 데이터 저장·처리 - 금융, 정부, 통신, 의료 분야의 데이터 레지던시 및 규정 준수 - 튀르키예 기업은 데이터를 국경 안에 저장하고 백업하면서, 지연 시간에 민감한 워크로드를 이스탄불에서 실행할 수 있다. - 이스탄불 Local Zone은 AWS 리전과 연결되므로, 자체 데이터센터를 운영하지 않고도 Local Zone과 리전을 결합한 하이브리드 애플리케이션을 구성할 수 있다. - Local Zone은 하드웨어, 전력, 네트워크, 운영 체계 측면에서 높은 수준의 인프라 투자가 필요한 서비스다. ## 보안 및 운영 업데이트 - **AWS Security Hub Extended** - 통합 가능한 파트너 보안 솔루션이 21개로 확대됐다. - 엔드포인트 보호, CSPM, 위협 인텔리전스 등 9개 보안 영역을 다룬다. - AWS 및 서드파티 도구의 보안 탐지 결과를 Security Hub에서 통합·우선순위화할 수 있다. - 별도 커스텀 통합을 줄여 엔터프라이즈 보안 운영을 단순화한다. - **Secrets Manager Agent 개선** - 애플리케이션 시작 시 시크릿을 미리 가져오는 pre-fetch 기능이 추가됐다. - 요청 시 시크릿을 조회하면서 발생하던 콜드 스타트와 지연 시간을 줄일 수 있다. - IAM 역할을 맡아 시크릿을 조회할 수 있어, 서로 다른 권한 경계를 가진 워크로드 간 에이전트 공유가 쉬워졌다. - **AWS SDK 및 CLI 재시도 동작 변경** - 일시적 오류와 API throttling에 더 효과적으로 대응하도록 기본 재시도 로직이 개선됐다. - 더 지능적인 백오프 전략이 적용된다. - 별도 설정 변경 없이 프로덕션 애플리케이션의 복원력을 높일 수 있다. ## AI 개발 및 모델 이전 편의성 - **SageMaker AI의 OpenAI 호환 API** - SageMaker 추론 엔드포인트를 OpenAI API와 호환되는 방식으로 호출할 수 있다. - 기존 OpenAI용 SDK나 애플리케이션 코드를 크게 수정하지 않고 SageMaker로 전환할 수 있다. - 애플리케이션에서 엔드포인트 주소만 변경해 여러 모델 제공자나 AWS 인프라를 활용할 수 있다. - OpenAI 기반 프로토타입을 비용과 확장성을 고려한 SageMaker 환경으로 이전하는 장벽을 낮춘다. - **Amazon Bedrock 프롬프트 최적화 및 마이그레이션 도구** - 프롬프트를 자동으로 조정해 모델 성능을 개선한다. - 서로 다른 파운데이션 모델 사이에서 프롬프트를 이전하는 작업을 지원한다. - 프로덕션 AI 서비스의 프롬프트 품질을 반복적으로 개선하는 데 유용하다. - **Kiro Web** - AWS의 AI 기반 개발 환경 Kiro를 웹 브라우저에서 사용할 수 있게 됐다. - 데스크톱 IDE 설치 없이 스펙 기반 개발, AI 채팅, 에이전트 기능을 이용할 수 있다. - 다른 컴퓨터에서 빠르게 검토하거나 프로토타입을 제작하고, 팀에 Kiro 워크플로를 소개하기 쉬워졌다. ## ExtendDB와 데이터 계층의 이식성 - AWS가 **ExtendDB**를 오픈소스로 공개했다. - DynamoDB API와 데이터 모델을 사용하면서, 실제 저장소는 다른 백엔드 시스템으로 구성할 수 있는 어댑터다. - 주요 활용 사례는 다음과 같다. - 로컬 개발 및 테스트 환경에서 실제 AWS 연결 없이 DynamoDB API 사용 - 저장소 계층을 직접 제어해야 하는 환경 - DynamoDB 호환 의미론을 유지하면서 특정 백엔드에 종속되지 않는 구조 - 데이터 접근 계층의 이식성을 높이고, 개발·테스트 환경 구축 비용을 줄이는 데 도움이 된다. ## 서버리스 로컬 개발 개선 - AWS SAM CLI가 CloudFormation Language Extensions를 로컬에서 지원한다. - 로컬 개발 및 테스트 과정에서 다음과 같은 CloudFormation 기능을 사용할 수 있다. - 트랜스폼 - 동적 참조 - 기타 CloudFormation 언어 확장 기능 - 로컬 환경과 실제 배포 환경 사이의 기능 차이를 줄인다. - SAM 기반 서버리스 애플리케이션에서 로컬 테스트로 재현하기 어려웠던 엣지 케이스를 더 안정적으로 검증할 수 있다. ## 컨테이너 이미지 및 생태계 변경 - Amazon ECR Public에서 Bitnami 컨테이너 이미지가 제거될 예정이다. - ECR Public에서 Bitnami 이미지를 가져오는 워크로드는 영향을 받을 수 있다. - Bitnami 자체 레지스트리에서는 이미지가 계속 제공된다. - 운영 중인 이미지 참조를 Bitnami 레지스트리로 변경하고, 제거 일정과 마이그레이션 절차를 확인해야 한다. ## 예정된 AWS 행사 - AWS Summit Amsterdam: 5월 27일 개최 - AWS Summit Bangkok: 5월 28일 개최 - AWS Summit Milan: 5월 28일 개최 예정 - 클라우드·AI 세션, 실습, 네트워킹 등을 제공하며 유럽과 동남아시아 개발자 및 고객을 대상으로 한다. 실무적으로는 ECR Public의 Bitnami 이미지 의존성을 먼저 점검하고, OpenAI 호환 SageMaker API와 Secrets Manager Agent pre-fetch를 기존 서비스에 적용할 수 있는지 검토하는 것이 좋다. 튀르키예에서 서비스를 운영하거나 데이터 레지던시가 중요한 경우에는 이스탄불 Local Zone을 활용한 리전-Local Zone 아키텍처도 고려할 만하다.

원문 읽기(새 탭에서 열림)
aws4분 읽기큐레이션 요약

AWS 주간 요약: AWS Transform 출시 1주년, AWS의 Claude 플랫폼, EC2 M3 Ultra Mac 인스턴스 등 (2026년 5월 18일) | Amazon Web Services

AWS는 기업 애플리케이션 현대화를 위한 AWS Transform을 출시 1년 만에 대규모 코드·서버 마이그레이션 서비스로 확장했으며, Kiro·Claude·Cursor·Codex에서도 Transform 에이전트를 사용할 수 있게 했다. 이번 주에는 Claude Platform의 AWS 정식 출시, 고성능 EC2 M3 Ultra Mac 인스턴스, Graviton 기반 Redshift RG 인스턴스 등 AI·개발·데이터 분석 관련 기능이 다수 공개됐다. 또한 보안 코드 분석, 멀티클라우드 연결, AI 연구 지원과 스타트업 크레딧 등 개발자와 기업을 위한 생태계 지원도 강화됐다. ## AWS Transform 출시 1년과 에이전트 확장 - AWS Transform은 .NET, 메인프레임, VMware 워크로드의 대규모 현대화를 지원하는 에이전트 기반 서비스다. - AWS Transform custom을 통해 다음 작업을 AWS 관리형 또는 사용자 정의 변환으로 수행할 수 있다. - 프로그래밍 언어 버전 업그레이드 - 프레임워크 마이그레이션 - 성능 최적화 - 코드베이스 분석 - Windows 전체 스택 현대화, 메인프레임 Reimagine 기능, 자동화된 테스트 기능도 추가됐다. - 1년 동안 수천 개 고객이 수십만 대의 서버를 마이그레이션했으며, 160만 시간 이상을 절감하고 45억 줄 이상의 코드를 처리했다. - AWS Transform 에이전트는 Kiro, Claude, Cursor, Codex에서 사용할 수 있고, Kiro의 에이전트 빌더 툴킷으로 맞춤형 변환 에이전트를 만들 수 있다. ## Claude Platform on AWS 정식 출시 - Anthropic의 네이티브 Claude Platform을 기존 AWS 계정에서 직접 이용할 수 있다. - 별도의 계정, 결제 체계, 사용량 추적을 관리할 필요가 없다. - Claude API와 콘솔, 얼리 액세스 베타 기능을 제공한다. - 서비스 운영 주체는 Anthropic이며, 고객 데이터는 AWS 보안 경계 외부에서 처리된다는 점에 유의해야 한다. ## EC2 M3 Ultra Mac 인스턴스 - Apple M3 Ultra Mac Studio 기반의 EC2 인스턴스로, Apple 애플리케이션 개발과 온디바이스 머신러닝 작업을 대상으로 한다. - 주요 사양: - 28코어 CPU - 60코어 GPU - 32코어 Neural Engine - 256GB 통합 메모리 - 이전 세대 M4 Max Mac 인스턴스와 비교하면 통합 메모리는 2배, CPU 코어는 1.75배, GPU 코어는 1.5배, Neural Engine 코어는 2배다. - 더 많은 Xcode 시뮬레이터를 병렬 실행하고 ML 워크로드를 가속해 제품 출시 시간을 단축할 수 있다. ## Graviton 기반 Amazon Redshift RG 인스턴스 - AWS Graviton 프로세서를 사용하는 Redshift RG 인스턴스가 출시됐다. - 기존 RA3 인스턴스보다 데이터 웨어하우스와 데이터 레이크 워크로드를 최대 2.4배 빠르게 처리한다. - vCPU당 가격은 이전 세대보다 30% 낮다. - 클러스터 노드에서 Apache Iceberg 및 Parquet 데이터를 처리하는 자체 벡터화 데이터 레이크 쿼리 엔진을 포함한다. ## Bedrock 프롬프트 최적화 - Amazon Bedrock의 모든 모델에 대해 프롬프트를 최적화할 수 있다. - 원래 프롬프트와 최적화된 프롬프트의 결과를 최대 5개 모델에서 동시에 비교할 수 있다. - 모델을 교체하거나 현재 모델의 응답 품질과 성능을 개선하려는 경우 유용하다. ## AWS Security Agent의 전체 저장소 분석 - AWS Security Agent가 저장소 전체를 대상으로 문맥을 고려한 심층 보안 분석을 수행한다. - 취약점을 발견하면 정확한 파일과 코드 줄에 연결된 구체적인 수정 코드를 생성한다. - 기존 AWS Security Agent 고객은 프리뷰 기간 동안 추가 비용 없이 사용할 수 있다. ## OCI와의 멀티클라우드 연결 - AWS Interconnect를 사용해 Oracle Cloud Infrastructure와 탄력적이고 확장 가능한 프라이빗 연결을 빠르게 구성할 수 있다. - 동일한 개방형 사양을 기반으로 OCI와 Google Cloud를 지원한다. - Google Cloud 연결은 정식 제공 중이며, Microsoft Azure 연결은 2026년 후반 제공될 예정이다. ## AI 연구 및 개발자 생태계 지원 - AWS는 대학 연구자들이 Trainium 칩을 사용할 수 있도록 1억 1,000만 달러를 투자했다. - UC Berkeley, MIT, Carnegie Mellon 등에서 Trainium 기반 AI 연구가 진행되고 있다. - 연구 결과는 오픈 소스로 공개되어 관련 개선 사항이 개발자 커뮤니티에 공유된다. - AWS Community Days 2026이 전 세계 여러 도시에서 개최된다. - Kiro Startups Credit 프로그램이 재개되어, 선정된 스타트업은 AWS 계정에서 최대 1년간 Kiro Pro+ 크레딧을 받을 수 있다. 실무적으로는 AWS Transform을 기존 레거시 현대화 계획과 검토하고, Claude Platform 사용 시 데이터 처리 경계를 확인하는 것이 좋다. Apple 개발팀은 M3 Ultra Mac의 병렬 시뮬레이터 성능을, 데이터팀은 Redshift RG의 성능 대비 비용을 각각 워크로드 기준으로 평가할 만하다.

원문 읽기(새 탭에서 열림)
aws3분 읽기큐레이션 요약

Amazon Bedrock, 새로운 고급 프롬프트 최적화 및 마이그레이션 도구 출시 | Amazon Web Services

Amazon Bedrock의 **Advanced Prompt Optimization**은 여러 모델에서 프롬프트를 자동으로 개선하고, 기존 프롬프트와 최적화된 프롬프트의 성능을 비교하는 도구입니다. 사용자는 예시 입력, 정답 데이터, 평가 기준을 제공하면 되며, 모델 마이그레이션이나 현재 모델의 성능 개선에 활용할 수 있습니다. 최적화 결과로 프롬프트, 평가 점수, 비용 추정치, 지연 시간이 함께 제공됩니다. ## 여러 모델을 동시에 비교하는 프롬프트 최적화 - 최대 5개의 Amazon Bedrock 추론 모델을 선택할 수 있습니다. - 새 모델로 마이그레이션하는 경우: - 현재 모델을 기준선으로 선택 - 최대 4개의 후보 모델과 성능 비교 - 모델을 변경하지 않는 경우에도 현재 모델의 최적화 전후 결과를 비교할 수 있습니다. - 알려진 사용 사례에서 성능 저하가 없는지 확인하거나, 성능이 낮은 작업을 개선하는 데 사용할 수 있습니다. ## 입력 데이터와 JSONL 템플릿 - 프롬프트 템플릿은 JSONL 형식으로 준비해야 합니다. - 각 JSON 객체는 한 줄에 작성해야 합니다. - 주요 필드는 다음과 같습니다. - `version`: 고정값 `bedrock-2026-05-14` - `templateId`: 프롬프트 템플릿 식별자 - `promptTemplate`: 최적화할 프롬프트 - `evaluationSamples`: 입력 변수와 선택적 기준 응답 - `steeringCriteria`: 자연어 기반 최적화 기준 - `customLLMJConfig`: 사용자 정의 LLM 평가 설정 - `evaluationMetricLambdaArn`: Lambda 기반 평가 함수 - 파일은 직접 업로드하거나 Amazon S3에서 가져올 수 있습니다. - 최적화 결과와 평가 데이터가 저장될 S3 출력 위치도 지정할 수 있습니다. ## 멀티모달 프롬프트 지원 - 텍스트 입력뿐 아니라 이미지와 문서가 포함된 프롬프트도 최적화할 수 있습니다. - 지원 파일 형식: - PNG - JPG - PDF - `inputVariablesMultimodal` 필드에 파일 유형과 S3 URI를 지정합니다. - 문서 분석, 이미지 분석과 같은 멀티모달 작업의 프롬프트 개선에 적합합니다. ## 평가 방식 세 가지 ### Lambda 기반 사용자 정의 평가 - 정확도, F1 점수, 실행 정확도, 구조화된 JSON 일치 여부처럼 명확한 수치 평가에 적합합니다. - Python으로 작성한 Lambda 함수에서 모델 응답과 기준 응답을 비교합니다. - `evaluationMetricLambdaArn`을 통해 평가 Lambda를 연결합니다. - 핵심 로직은 모델 출력과 정답을 비교해 점수를 계산하는 `compute_score` 구현입니다. ### LLM-as-a-Judge 평가 - 요약, 생성, 추론 설명처럼 정답이 하나로 정해지지 않은 작업에 적합합니다. - 사용자 정의 평가 프롬프트와 평가 기준, 점수 척도를 설정할 수 있습니다. - Bedrock의 평가 모델이 각 프롬프트와 응답을 평가하고 점수와 판단 근거를 반환합니다. - 기본 평가 모델은 Claude Sonnet 4.6이며, 지원되는 다른 평가 모델을 선택할 수도 있습니다. - 설정은 `customLLMJConfig`에 지정합니다. ### 자연어 기반 Steering Criteria - 브랜드 문체, 출력 형식, 안전 제약 등 원하는 품질을 자연어로 설명할 때 사용합니다. - 직접 복잡한 평가 프롬프트나 점수 체계를 작성하지 않아도 됩니다. - `steeringCriteria` 배열에 원하는 기준을 입력합니다. - 기본 LLM 평가 프롬프트가 해당 기준을 반영해 응답을 종합적으로 평가합니다. - 이 방식에서도 Claude Sonnet 4.6이 평가 모델로 사용됩니다. ## 피드백 루프와 결과 확인 - Bedrock은 프롬프트와 예시 데이터를 선택한 모델에 전달합니다. - 모델 응답을 지정한 평가 방식으로 채점합니다. - 평가 결과를 바탕으로 프롬프트를 다시 작성합니다. - 이 과정을 반복해 평가 지표에 맞는 프롬프트를 탐색합니다. - 최종적으로 다음 정보를 확인할 수 있습니다. - 원본 및 최적화된 프롬프트 템플릿 - 모델별 평가 점수 - 예상 비용 - 응답 지연 시간 - 평가 데이터와 결과 ## 사용 방법과 제공 지역 - Amazon Bedrock 콘솔의 **Advanced Prompt Optimization** 페이지에서 `Create prompt optimization`을 선택합니다. - API를 사용하려면 `CreateAdvancedPromptOptimizationJob`을 호출합니다. - 미국, 아시아 태평양, 캐나다, 유럽, 남미의 여러 리전에서 제공됩니다. - 최적화 과정에서 사용된 Bedrock 모델 추론 토큰에 대해 일반 추론과 동일한 토큰 요금이 부과됩니다. 실무에서는 먼저 정확도나 JSON 일치처럼 측정 가능한 작업은 Lambda 평가로 시작하고, 요약·문체·안전성처럼 정성적인 작업은 LLM-as-a-Judge 또는 Steering Criteria를 사용하는 것이 적합합니다. 모델을 교체할 때는 기존 모델을 기준선으로 포함해 품질뿐 아니라 비용과 지연 시간까지 함께 비교하는 것이 좋습니다.

원문 읽기(새 탭에서 열림)
aws3분 읽기큐레이션 요약

워크플로 현대화: Amazon WorkSpaces, 이제 AI 에이전트에 자체 데스크톱 제공(미리 보기) | Amazon Web Services

Amazon WorkSpaces는 레거시 애플리케이션을 API로 현대화하지 않아도 AI 에이전트가 데스크톱 환경에서 직접 조작할 수 있도록 지원한다. 에이전트는 직원과 동일한 관리형 가상 데스크톱에서 애플리케이션을 사용하며, IAM 인증과 CloudTrail·CloudWatch 감사 추적을 적용받는다. 이를 통해 기업은 대규모 마이그레이션 없이 기존 업무 시스템에 AI 자동화를 도입할 수 있다. ## 레거시 애플리케이션의 AI 접근성 문제 - 2024년 Gartner 보고서에 따르면 조직의 75%가 현대적인 API가 없는 레거시 애플리케이션을 운영한다. - Fortune 500 기업의 71%는 프로그래밍 방식 접근이 부족한 메인프레임에서 핵심 업무를 처리한다. - 기업은 AI 도입을 미루거나, 비용과 위험이 큰 애플리케이션 현대화 프로젝트를 진행해야 했다. - WorkSpaces는 애플리케이션을 재개발하거나 API를 새로 구축하지 않고도 이 문제를 해결한다. ## AI 에이전트를 위한 보안 데스크톱 - AI 에이전트는 관리형 WorkSpaces 환경 내부에서 데스크톱 애플리케이션을 실행한다. - AWS IAM을 통해 에이전트를 인증하고, 에이전트별 자격 증명과 권한을 적용한다. - AWS CloudTrail과 Amazon CloudWatch를 이용해 세션과 작업을 감사·모니터링할 수 있다. - 로컬 컴퓨터가 아닌 격리된 클라우드 데스크톱에서 동작하므로 기존 보안 정책과 컴플라이언스 통제를 유지할 수 있다. - 직원용으로 사용하던 WorkSpaces 인프라를 AI 에이전트용 실행 환경으로 확장할 수 있다. ## MCP 기반 에이전트 연동 - WorkSpaces는 업계 표준인 Model Context Protocol(MCP)을 지원한다. - MCP 엔드포인트를 통해 에이전트 프레임워크와 WorkSpaces를 연결할 수 있다. - LangChain, CrewAI, Strands Agents 등 다양한 프레임워크와 함께 사용할 수 있다. - 별도의 애플리케이션별 API 통합 없이 에이전트가 데스크톱의 사용자 인터페이스를 조작한다. ## 에이전트 접근 환경 설정 - WorkSpaces Applications 스택을 생성해 에이전트의 연결 방식과 권한을 정의한다. - 스택 설정에서 기본값인 `No AI agent access` 대신 `Add AI Agents`를 선택하면 에이전트 접속을 활성화할 수 있다. - 주요 에이전트 기능은 다음과 같다. - **Computer input**: 클릭, 입력, 스크롤 수행 - **Computer vision**: 화면을 캡처해 애플리케이션 상태 인식 - **Screenshot storage**: 감사 및 디버깅을 위한 세션 스크린샷 저장 - 화면 해상도와 이미지 형식도 지정할 수 있다. - 예시 설정: 1280×720 해상도, PNG 형식 - 복잡하고 조밀한 UI는 더 높은 해상도가 유리할 수 있다. - 터미널 중심 인터페이스는 720p 수준으로도 충분할 수 있다. ## API 없이 기존 업무 애플리케이션 자동화 - Strands Agent SDK와 Amazon Bedrock으로 구현한 에이전트가 샘플 약국 시스템에서 처방전 리필 업무를 수행했다. - 에이전트는 환자 기록 조회, 약품 검색, 주문, 처방전 갱신 확인을 모두 화면 조작으로 처리했다. - 해당 애플리케이션은 에이전트가 사용 중이라는 사실을 인식하지 못한다. - 애플리케이션 수정, 재빌드, API 통합 없이 현재 상태 그대로 사용할 수 있다는 점이 핵심이다. ## 제공 범위와 도입 방법 - 현재 퍼블릭 프리뷰로 제공되며 추가 비용은 없다. - 지원 리전에는 미국 동부·서부, 캐나다, 유럽 주요 리전, 도쿄·뭄바이·시드니·서울·싱가포르 등이 포함된다. - AWS Management Console에서 WorkSpaces Applications 스택을 생성하고 AI 에이전트 접근을 활성화한 뒤, MCP 엔드포인트와 IAM 인증 정보를 에이전트 프레임워크에 설정한다. - AWS GitHub 저장소와 WorkSpaces 공식 페이지를 통해 구현을 시작할 수 있다. 기존 데스크톱 애플리케이션을 빠르게 자동화하려는 기업에는 유용한 접근 방식이다. 다만 퍼블릭 프리뷰 단계이므로 실제 도입 전 권한 범위, 화면 캡처의 민감정보 처리, 감사 로그 보존 정책을 충분히 검토하는 것이 좋다.

원문 읽기(새 탭에서 열림)
aws5분 읽기큐레이션 요약

AWS 주간 요약: AWS 2026의 향후 계획, Amazon Quick, OpenAI 파트너십 등 (2026년 5월 4일) | Amazon Web Services

AWS는 2026년 들어 생성형 AI와 에이전트 중심으로 서비스를 빠르게 확장하고 있다. Amazon Quick은 업무 자동화와 콘텐츠 생성을 강화했고, Amazon Connect는 공급망·채용·고객지원·의료를 아우르는 4개 에이전트 솔루션으로 확대됐다. 또한 AWS와 OpenAI는 Bedrock을 통해 OpenAI 모델과 Codex를 AWS 환경에서 사용할 수 있도록 협력을 강화했다. ## Amazon Quick의 업무 자동화 확대 - Amazon Quick은 앱과 연결해 사용자의 업무 맥락을 파악하고 대신 작업을 수행하는 AI 비서다. - 브라우저 없이 로컬 파일, 캘린더, 커뮤니케이션에 접근할 수 있는 데스크톱 앱을 프리뷰로 제공한다. - AWS 계정 없이 개인 이메일이나 Google, Apple, GitHub, Amazon 계정으로 가입할 수 있다. - 채팅 인터페이스에서 다음 콘텐츠를 직접 생성할 수 있다. - 문서 - 프레젠테이션 - 인포그래픽 - 이미지 - Google Workspace, Zoom, Airtable, Dropbox, Microsoft Teams와의 네이티브 통합이 추가됐다. - 자연어로 지시해 비즈니스 데이터와 연결된 앱, 대시보드, 웹 페이지를 만드는 기능도 프리뷰로 제공된다. ## Amazon Connect의 에이전트 AI 사업 확장 Amazon Connect는 고객센터 제품을 넘어 네 가지 업무 영역별 에이전트 AI 솔루션으로 확대됐다. - **Amazon Connect Decisions** - 공급망 계획 및 인텔리전스 솔루션이다. - Amazon의 30년 운영 노하우와 25개 이상의 공급망 도구를 결합한다. - 문제가 발생한 뒤 대응하는 방식에서 벗어나 선제적 계획 수립을 지원한다. - **Amazon Connect Talent** - 대규모 채용을 위한 에이전트형 AI 채용 솔루션이다. - AI 주도 인터뷰, 과학 기반 평가, 일관된 지원자 평가를 제공한다. - 현재 프리뷰로 제공된다. - **Amazon Connect Customer** - 기존 Amazon Connect를 확장한 고객경험 솔루션이다. - 음성, 채팅, 디지털 채널에서 개인화된 고객 응대를 지원한다. - 대화형 AI를 수개월이 아니라 수주 내 구성할 수 있도록 설정 기능을 강화했다. - **Amazon Connect Health** - 환자 확인, 예약 관리, 환자 인사이트, 주변 대화 기반 문서화, 의료 코딩을 자동화한다. - 환자는 더 빠르게 진료를 받고, 의료진은 문서 작업보다 진료에 집중할 수 있도록 설계됐다. ## AWS와 OpenAI의 Bedrock 협력 - AWS와 OpenAI는 최신 OpenAI 모델을 Amazon Bedrock에서 사용할 수 있도록 제한적 프리뷰를 시작했다. - GPT-5.5와 GPT-5.4 등을 기존 Bedrock API를 통해 사용할 수 있다. - 사용자는 별도 인프라나 새로운 보안 모델을 익히지 않고 Bedrock의 보안, 거버넌스, 비용 관리 체계를 그대로 활용할 수 있다. - **Codex on Amazon Bedrock** - OpenAI의 코딩 에이전트를 기존 AWS 환경에서 실행한다. - AWS 자격 증명으로 인증하고, 추론은 Bedrock을 통해 처리한다. - Codex 사용량을 AWS 클라우드 약정에 반영할 수 있다. - Codex CLI, 데스크톱 앱, Visual Studio Code 확장에서 사용할 수 있다. - **Amazon Bedrock Managed Agents** - OpenAI 모델과 AWS 인프라를 결합해 운영 환경용 에이전트를 구축한다. - OpenAI 하니스를 사용해 장시간 작업의 실행력, 추론, 제어 안정성을 높이는 것을 목표로 한다. ## 고성능 EC2 인스턴스 출시 - **M8in·M8ib** - 6세대 Intel Xeon Scalable 프로세서와 6세대 AWS Nitro 카드를 사용한다. - M6in·M6ib보다 최대 43% 높은 성능을 제공한다. - M8in은 최대 600Gbps 네트워크 대역폭, M8ib는 최대 300Gbps EBS 대역폭을 지원한다. - **R8in·R8ib** - 메모리 최적화 인스턴스다. - 대규모 상용 데이터베이스, 데이터 레이크, SAP HANA 같은 인메모리 데이터베이스에 적합하다. - 최대 600Gbps 네트워크와 300Gbps EBS 대역폭을 제공한다. - **C8ine·M8ine** - 네트워크 최적화 인스턴스다. - C6in·M6in 대비 vCPU당 패킷 처리 성능이 최대 2.5배, 인터넷 게이트웨이 경유 네트워크 처리량이 최대 2배 향상됐다. - 가상 방화벽, 로드 밸런서, 5G UPF 등 보안·네트워크 가상 어플라이언스에 적합하다. ## Bedrock AgentCore의 운영 최적화 - Bedrock AgentCore 프리뷰에 에이전트 개선 기능이 추가됐다. - 운영 환경의 추적 데이터와 평가 결과를 분석해 시스템 프롬프트와 도구 설명 개선안을 추천한다. - 추천 결과는 다음 방식으로 검증할 수 있다. - 사전 정의된 테스트 케이스를 활용한 일괄 평가 - 실제 트래픽을 대상으로 한 A/B 테스트 - 모든 추천 사항은 사용자가 승인해야 운영 환경에 반영된다. - 관찰, 평가, 개선의 반복 과정을 자동화해 운영 중인 에이전트의 품질을 높이는 구조다. ## AWS Lambda와 Ruby 4.0 지원 - AWS Lambda가 최신 LTS 버전인 Ruby 4.0을 관리형 런타임과 컨테이너 기본 이미지로 지원한다. - 고급 로깅 기능을 사용할 수 있다. - JSON 구조화 로그 - 로그 레벨 설정 - 대상 CloudWatch 로그 그룹 지정 - 중국 리전과 AWS GovCloud를 포함한 모든 AWS 리전에서 제공된다. ## Amazon Q Developer에서 Kiro로의 전환 - Amazon Q Developer IDE 플러그인과 유료 구독은 2027년 4월 30일 지원 종료 예정이다. - 신규 가입은 2026년 5월 15일부터 차단된다. - 기존 구독자는 계속 사용자를 추가할 수 있지만, 2026년 5월 29일부터 Q Developer Pro에서 Opus 4.6은 사용할 수 없다. - Opus 4.5 및 기존 모델은 유지되며, 최신 코딩 모델인 Opus 4.7 등은 Kiro에서만 제공된다. - AWS 관리 콘솔의 Amazon Q Developer와 문서, 모바일 앱, Slack, Microsoft Teams 등 AWS의 퍼스트파티 경험은 이번 종료 대상이 아니다. ## 실용적인 시사점 - 기업은 Bedrock을 중심으로 OpenAI 모델과 AWS의 보안·거버넌스·비용 관리 체계를 함께 활용할 수 있게 됐다. - 업무 자동화 도입을 검토한다면 Quick은 문서 생성과 사내 도구 연결에, Connect는 고객지원·채용·공급망·의료 프로세스에 적합하다. - 대규모 데이터베이스나 네트워크 집약적 워크로드는 새 M8·R8·C8 계열의 대역폭과 패킷 처리 성능을 기존 인스턴스와 비교해 검토할 만하다. - Amazon Q Developer 사용 조직은 지원 종료 일정과 Kiro 전환 계획을 미리 점검해야 한다.

원문 읽기(새 탭에서 열림)
aws원문

AWS 주간 정리: Anthropic과 Meta의 파트너십, AWS Lambda S3 파일, Amazon Bedrock AgentCore CLI 등 (2026년 4월 27일) | Amazon Web Services (새 탭에서 열림)

이번 AWS 주간 소식은 Anthropic 및 Meta와의 전략적 파트너십 강화와 생성형 AI 에이전트 개발을 가속화하는 기술적 진보에 초점을 맞추고 있습니다. AWS는 실리콘 레벨에서의 최적화와 서버리스 기술의 고도화를 통해 복잡한 AI 워크로드를 더 효율적으로 처리할 수 있는 환경을 구축하고 있습니다. 결과적으로 개발자들은 하 인프라의 복잡성에서 벗어나 더 정교하고 협업 중심적인 AI 애플리케이션 구축에 집중할 수 있게 되었습니다. **Anthropic 및 Meta와의 전략적 파트너십 확대** - Anthropic은 AWS Trainium 및 Graviton 인프라를 활용해 최신 파운데이션 모델을 학습시키며, 하드웨어와 소프트웨어 스택 전반의 효율성을 극대화하기 위해 Annapurna Labs와 협력합니다. - Amazon Bedrock 내에서 'Claude Cowork'가 출시되어, 기업 고객들은 AWS의 보안 환경을 유지하면서 팀 단위의 협업 AI 워크플로우를 직접 배포할 수 있습니다. - Meta는 추론, 코드 생성, 다단계 작업 오케스트레이션 등 CPU 집약적인 에이전트 중심 AI 워크로드를 위해 수천만 개의 AWS Graviton 코어를 도입하기로 합의했습니다. **Lambda 및 Aurora의 서버리스 기능 강화** - **Lambda S3 Files:** Amazon EFS를 기반으로 구축된 이 기능을 통해 Lambda 함수가 S3 버킷을 파일 시스템으로 마운트할 수 있으며, 데이터 다운로드 없이 표준 파일 작업을 수행할 수 있어 AI 모델의 메모리 유지 및 상태 공유가 용이해졌습니다. - **Aurora Serverless 성능 향상:** 새로운 플랫폼 버전 4에서는 이전보다 최대 30% 향상된 성능과 스마트 스케일링 알고리즘을 제공하며, 사용하지 않을 때는 비용이 발생하지 않는 'Scale to zero' 기능을 유지합니다. - **EKS Hybrid Nodes 게이트웨이:** 온프레미스와 클라우드 간의 복잡한 네트워크 인프라 변경 없이도 하이브리드 Kubernetes 환경의 네트워킹을 자동화하여 포드 간 통신을 간소화합니다. **AI 에이전트 개발 및 운영 효율화 도구** - **Bedrock AgentCore:** 새로운 CLI와 관리형 하네스(Managed Harness)를 도입하여 오케스트레이션 코드 없이도 모델, 프롬프트, 도구를 정의해 즉시 에이전트 프로토타입을 실행하고 이를 IaC(AWS CDK 등)로 내보낼 수 있습니다. - **세분화된 비용 할당:** Amazon Bedrock 사용량을 태그 기반으로 상세하게 추적할 수 있게 되어, 여러 팀이나 프로젝트를 운영하는 조직에서 정밀한 비용 가시성과 비용 재청구(Chargeback)가 가능해졌습니다. - **SageMaker 추론 최적화 권장:** 생성형 AI 모델 배포 시 최적의 인스턴스 타입, 컨테이너, 추론 파라미터를 자동으로 식별하여 비용을 절감하고 응답 속도를 개선합니다. **실무자를 위한 교육 및 이벤트 정보** - **무료 마이크로디그리(Microcredentials):** AWS Skill Builder를 통해 실제 라이브 환경에서 구성, 트러블슈팅, 최적화 기술을 검증하는 실무형 인증 과정을 무료로 이용할 수 있습니다. - **AWS Summit Seoul:** 오는 5월 20일 서울에서 개최되는 서밋을 포함하여 전 세계 주요 도시에서 최신 클라우드 및 AI 혁신 사례를 공유하는 오프라인 행사가 진행될 예정입니다. 생성형 AI를 실제 서비스에 적용하려는 개발자라면 Bedrock AgentCore를 통한 신속한 프로토타이핑을 시도해보고, 비용 최적화를 위해 Graviton 기반 인스턴스와 SageMaker의 추론 권장 기능을 적극적으로 활용해 보시기 바랍니다.

gitlab원문

GitLab + Amazon: 신뢰할 수 있는 AI 기반의 플랫폼 오케스트레이션 (새 탭에서 열림)

GitLab Duo Agent Platform과 Amazon Bedrock의 결합은 기업이 보안과 규제 준수를 유지하면서 소프트웨어 개발 생애 전반에 에이전트 기반 AI를 도입할 수 있는 강력한 토대를 제공합니다. GitLab은 워크플로우 오케스트레이션 레이어 역할을 수행하고, Bedrock은 신뢰할 수 있는 모델 추론 인프라를 담당함으로써 파편화된 AI 도구 확산을 막고 클라우드 투자의 효율성을 극대화합니다. 이를 통해 개발팀은 데이터 주권을 유지하면서도 보안 스캐닝, 파이프라인 최적화 등 복잡한 개발 작업을 지능적으로 자동화할 수 있습니다. **기존 AI 도입의 구조적 문제점** * **운영 파편화:** 개별 팀이나 개발자가 승인되지 않은 AI 도구를 제각각 사용함에 따라 엔드 투 엔드 거버넌스 수립이 불가능해지는 현상이 발생합니다. * **보안 및 데이터 주권:** 프롬프트와 코드 데이터가 외부로 유출될 위험이 있으며, 로그 소유권 및 데이터 흐름에 대한 불확실성이 존재합니다. * **클라우드 지출 최적화:** 기존 AWS 사용 약정과는 별개로 개별 AI 도구에 비용이 지출되면서 기업의 클라우드 전략 및 비용 효율성이 저하됩니다. **GitLab Duo Agent Platform: 에이전트 기반 제어 평면** * **병렬적 자동화:** 전통적인 단계별 방식에서 벗어나, 여러 전문 에이전트가 이슈, 머지 리퀘스트(MR), 보안 취약점 등 프로젝트 컨텍스트를 공유하며 동시에 작업을 수행합니다. * **통합 오케스트레이션:** 단순한 채팅 보조 도구를 넘어, GitLab의 AI Gateway를 통해 Bedrock 모델을 호출하고 소프트웨어 수명 주기 전반의 워크플로우를 지휘합니다. * **맥락 중심 협업:** 이슈 데이터와 파이프라인 결과를 실시간으로 활용하여 AI 에이전트와 개발팀 간의 유기적인 협업 환경을 구축합니다. **Amazon Bedrock: 신뢰할 수 있는 AI 인프라** * **완벽한 데이터 격리:** 서버리스 기반의 완전 관리형 서비스로, 모든 데이터는 고객의 AWS 계정 내에 머물며 모델 학습에 절대 사용되지 않습니다. * **강력한 규제 준수:** GDPR, HIPAA, FedRAMP High 등 주요 보안 인증을 획득하여 규제가 엄격한 산업군에서도 즉시 도입이 가능합니다. * **안전 장치 제공:** 'Bedrock Guardrails' 기능을 통해 콘텐츠 필터링, 환각 현상(Hallucination) 감지, 민감 정보 보호 기능을 모델 전반에 적용할 수 있습니다. **환경에 따른 세 가지 배포 옵션** * **완전 제어형:** GitLab Self-Managed 사용자가 자신의 AWS 계정에서 직접 Bedrock 모델과 AI 게이트웨이를 호스팅하여 데이터 통제권을 극대화합니다. * **관리형 서비스 연동:** GitLab Self-Managed 사용자가 GitLab에서 호스팅하는 AI 게이트웨이와 Bedrock 인프라를 활용하여 운영 부담을 줄입니다. * **SaaS 통합형:** GitLab.com(SaaS) 사용자가 GitLab 관리형 AI 인프라를 통해 별도의 설정 없이 Bedrock 기반의 AI 기능을 활용합니다. 기존에 AWS 인프라를 활용하면서 보안과 거버넌스를 중시하는 기업이라면, GitLab Duo와 Amazon Bedrock의 통합은 섀도우 AI(Shadow AI)를 방지하고 기술 스택을 단일화할 수 있는 최적의 해결책입니다. 특히 보안 취약점 자동 수정이나 파이프라인 최적화와 같이 신뢰도가 중요한 영역에서 Bedrock의 보안 가드레일을 활용하여 안전하게 AI를 확장해 나갈 것을 추천합니다.

aws원문

AWS 주간 요약: Amazon Bedrock의 Claude Opus 4.7, AWS Interconnect 정식 출시 등 (2026년 4월 20일) | Amazon Web Services (새 탭에서 열림)

AWS는 이번 발표를 통해 Anthropic의 가장 강력한 모델인 Claude Opus 4.7의 Amazon Bedrock 출시와 새로운 하이브리드 네트워킹 서비스인 AWS Interconnect의 정식 출시를 알렸습니다. AI 시대의 개발자는 도구에 대체되는 것이 아니라, 시스템 사고와 정교한 통신 역량을 바탕으로 더 높은 수준의 가치를 창출해야 한다는 비전을 제시합니다. 아울러 양자 내성 보안부터 고성능 컴퓨팅 인스턴스에 이르기까지 클라우드 전반의 성능과 보안을 강화하는 다채로운 업데이트가 포함되었습니다. **Claude Opus 4.7 및 Amazon Bedrock 고도화** * Anthropic의 최신 모델인 Claude Opus 4.7이 Bedrock에 출시되어 코딩, 장기 실행 에이전트, 전문 지식 업무에서 향상된 성능을 제공하며, 특히 SWE-bench Pro에서 64.3%의 높은 점수를 기록했습니다. * 요청의 복잡도에 따라 사고 토큰 예산을 동적으로 할당하는 '적응형 사고(Adaptive thinking)' 기능과 100만 토큰의 방대한 컨텍스트 윈도우를 지원합니다. * 고해상도 이미지 지원 기능이 추가되어 복잡한 차트, 밀집된 문서, 스크린 UI에 대한 분석 정확도가 크게 개선되었습니다. **멀티클라우드 및 라스트 마일 연결성 강화 (AWS Interconnect)** * 'AWS Interconnect - Multicloud'를 통해 AWS VPC와 타사 클라우드(Google Cloud 등) 간의 Layer 3 프라이빗 연결을 지원하며, 트래픽은 공용 인터넷을 거치지 않고 전용 백본망을 통해 전송됩니다. * 'AWS Interconnect - Last Mile'은 지사나 데이터 센터에서 AWS로의 고속 프라이빗 연결을 단순화하며, 최대 100Gbps 대역폭과 MACsec 암호화를 기본으로 제공합니다. * AWS는 관련 사양을 GitHub에 오픈 소스로 공개하여 다른 클라우드 제공업체들도 Interconnect 파트너가 될 수 있는 개방형 생태계를 구축했습니다. **개발 및 보안 운영의 자동화와 최적화** * **현대화 도구:** AI 에이전트 기반 마이그레이션 서비스인 'AWS Transform'이 VS Code 확장으로 제공되어, Java/Python 버전 업그레이드나 VB6 레거시 앱의 .NET Core 전환 작업을 IDE 내에서 직접 수행할 수 있습니다. * **보안 강화:** AWS Secrets Manager가 ML-KEM 기반의 하이브리드 양자 내성 TLS를 지원하기 시작하여 미래의 양자 컴퓨팅 위협으로부터 기밀 정보를 보호합니다. * **데이터 관리:** Amazon ECR의 풀스루 캐시가 OCI 참조(이미지 서명, SBOM 등) 동기화를 지원하여 컨테이너 보안 검증 워크플로우를 간소화했습니다. * **고성능 컴퓨팅:** 6세대 인텔 제온 프로세서 기반의 EC2 C8in/C8ib 인스턴스가 정식 출시되어, 이전 세대 대비 최대 43% 향상된 성능과 최대 600Gbps의 네트워크 대역폭을 제공합니다. **비용 관리 및 서버리스 고도화** * Amazon Bedrock에 IAM 주체별 세부 비용 속성 기능이 추가되어, 팀이나 프로젝트 단위로 AI 추론 비용을 정확하게 정산하고 관리할 수 있게 되었습니다. * Aurora DSQL은 PHP 전용 커넥터를 출시하여 IAM 토큰 생성, SSL 설정, 커넥션 풀링 등의 작업을 자동화함으로써 서버리스 데이터베이스 활용도를 높였습니다. 이번 업데이트는 AI 에이전트의 자율성을 극대화하고 멀티클라우드 환경의 네트워킹 장벽을 낮추는 데 중점을 두고 있습니다. 개발자들은 Claude Opus 4.7의 강화된 추론 능력과 AWS Transform 같은 자동화 도구를 적극 활용하여 레거시 시스템 현대화 속도를 높이고, 강화된 네트워킹 성능을 바탕으로 더 견고한 분산 시스템을 설계할 것을 권장합니다.

aws원문

Amazon Bedrock에서 Anthropic의 Claude Opus 4.7 모델 소개 | Amazon Web Services (새 탭에서 열림)

Amazon Bedrock에 Anthropic의 가장 지능적인 모델인 Claude Opus 4.7이 정식 출시되었습니다. 이 모델은 코딩, 장기 실행 에이전트, 전문 지식 작업 전반에서 이전 모델보다 뛰어난 성능을 발휘하며, Bedrock의 차세대 추론 엔진을 통해 기업급 인프라와 보안성을 보장합니다. 사용자는 이를 통해 복잡한 모호성을 해결하고 더 정교한 자율적 문제 해결 능력을 워크플로우에 도입할 수 있습니다. ### Claude Opus 4.7의 주요 성능 향상 - **에이전트 코딩 능력**: 자율적인 시스템 엔지니어링 및 복잡한 코드 추론 능력이 대폭 강화되었습니다. SWE-bench Verified(87.6%)와 Terminal-Bench 2.0(69.4%) 등 주요 벤치마크에서 업계 최고 수준의 성적을 기록했습니다. - **고도화된 지식 업무**: 금융 분석 및 다단계 연구 워크플로우에 최적화되었습니다. 모호한 요청에 대해 합리적인 가정을 스스로 세우고 출력을 자가 검증(Self-verify)함으로써 첫 단계부터 높은 품질의 결과물을 생성합니다. - **장기 작업 및 컨텍스트 처리**: 100만 토큰의 넓은 컨텍스트 윈도우 전체에서 일관성을 유지합니다. 긴 호흡의 작업 중에도 목표를 벗어나지 않고 모호한 상황을 추론하며 안정적으로 과업을 수행합니다. - **시각 지각 능력 강화**: 고해상도 이미지를 지원하여 차트, 밀집된 텍스트 문서, 정밀한 화면 UI 등 미세한 디테일이 중요한 시각 자료 분석 정확도가 개선되었습니다. ### 차세대 추론 엔진과 엔터프라이즈 보안 - **동적 용량 할당**: 새로운 스케줄링 및 확장 로직을 도입하여 워크로드 수요에 따라 용량을 동적으로 할당합니다. 이는 서비스 가용성을 높이고 급격한 트래픽 증가에도 유연하게 대응하게 해줍니다. - **제로 오퍼레이터 액세스**: 고객의 프롬프트와 응답 데이터에 대해 Anthropic이나 AWS 운영자가 접근할 수 없도록 설계되어, 민감한 데이터를 다루는 기업의 프라이버시를 철저히 보호합니다. - **효율적인 수요 관리**: 수요가 급증하는 시기에는 요청을 즉시 거절하는 대신 큐(Queue)에 대기시켜 처리합니다. 기본적으로 리전당 계정별 분당 최대 10,000건(RPM)의 요청을 즉시 처리할 수 있는 성능을 제공합니다. ### 개발자 편의 기능 및 활용 방법 - **적응형 사고(Adaptive Thinking)**: 요청의 복잡도에 따라 모델이 스스로 '사고 토큰(Thinking tokens)' 예산을 동적으로 할당합니다. 이를 통해 복잡한 논리 구성이 필요한 질문에 대해 더 깊은 추론 과정을 거칠 수 있습니다. - **다양한 API 선택지**: 대화형 인터페이스를 위한 Converse API, 직접 제어가 가능한 Invoke API, 그리고 Anthropic SDK를 통한 Messages API 등을 지원하여 기존 환경에 쉽게 통합할 수 있습니다. - **즉각적인 시작**: Amazon Bedrock 콘솔의 플레이그라운드에서 바로 테스트할 수 있으며, OpenAI 호환 API를 사용하거나 AWS CLI를 통해 프로그래밍 방식으로 모델을 호출하는 것도 가능합니다. 현재 Claude Opus 4.7은 미국 동부(버지니아 북부), 아시아 태평양(도쿄), 유럽(아일랜드, 스톡홀름) 리전에서 즉시 사용할 수 있습니다. 복잡한 코딩 에이전트를 구축하거나 고도의 추론이 필요한 엔터프라이즈 애플리케이션을 개발 중이라면, 이전 버전인 4.6에서 프롬프트를 미세 조정하여 Opus 4.7의 향상된 성능을 극대화해 보시기 바랍니다.

aws원문

AWS 주간 소식: Amazon Bedrock의 Claude Mythos 프리뷰, AWS Agent Registry 등 (2026년 4월 13일) | Amazon Web Services (새 탭에서 열림)

AWS는 이번 발표를 통해 AI 모델의 실험 단계를 넘어 실제 운영 환경에서의 비용 투명성과 관리 효율성을 높이는 데 주력하고 있습니다. 특히 Amazon Bedrock의 비용 할당 기능과 새로운 에이전트 레지스트리는 기업이 AI 자원을 체계적으로 거버넌스하고 최적화할 수 있는 기틀을 마련해 줍니다. 결과적으로 개발 가속화와 동시에 재무적 가시성을 확보하려는 기업들에게 실질적인 해결책을 제시하고 있습니다. ### AI 비용 관리 및 거버넌스 체계 구축 * **IAM 기반 Bedrock 비용 할당**: 이제 IAM 사용자 및 역할별로 Amazon Bedrock 사용 비용을 할당할 수 있습니다. 팀이나 비용 센터별로 태그를 지정해 AWS Cost Explorer 및 상세 비용 보고서(CUR)에서 모델 추론 비용을 명확히 추적할 수 있어 AI 투자의 가시성이 크게 향상되었습니다. * **AWS Agent Registry 출시**: 기업 내 AI 에이전트, 도구, MCP(Model Context Protocol) 서버 등을 통합 관리하는 프라이빗 카탈로그입니다. 시맨틱 검색과 승인 워크플로를 통해 중복 개발을 방지하고, CloudTrail을 통한 감사 추적 기능을 제공하여 에이전트 기반 시스템의 거버넌스를 강화합니다. ### 보안 및 관리형 AI 서비스 확장 * **Claude Mythos 프리뷰**: Anthropic의 가장 정교한 보안 특화 모델이 Amazon Bedrock에 연구 프리뷰 형태로 출시되었습니다. 소프트웨어 취약점 식별 및 대규모 코드베이스 분석에 탁월하며, 현재는 인터넷 주요 인프라 기업 및 오픈소스 유지 관리자를 중심으로 접근이 제한적으로 허용됩니다. * **Amazon WorkSpaces Advisor**: 생성형 AI를 활용하여 IT 관리자의 업무를 돕는 도구입니다. 가상 데스크톱 환경의 구성을 분석하고 문제를 자동으로 감지하여, 서비스 복구 및 성능 최적화를 위한 구체적인 권장 사항을 제공합니다. ### 고성능 데이터 스토리지 및 관측성 강화 * **Amazon S3 Files**: S3 버킷을 Amazon EFS 기술 기반의 파일 시스템으로 직접 연결하여 사용할 수 있습니다. 코드 수정 없이도 기존 파일 시스템 세맨틱을 유지하면서 초당 수 테라비트의 읽기 처리량을 확보할 수 있으며, S3 API와 파일 인터페이스를 동시에 사용할 수 있는 유연성을 제공합니다. * **OpenSearch 통합 관측성 지원**: Managed Prometheus 및 에이전트 트레이싱 기능이 추가되었습니다. 로그, 메트릭, 트레이스를 하나의 인터페이스에서 통합 관리할 수 있으며, 특히 LLM 실행 가시성을 위한 OpenTelemetry GenAI 시맨틱 컨벤션을 지원하여 AI 운영의 효율성을 높였습니다. ### 양자 컴퓨팅 및 고급 컴퓨팅 옵션 * **Rigetti 108 큐비트 QPU 지원**: Amazon Braket에서 Rigetti의 'Cepheus' 프로세서를 사용할 수 있게 되었습니다. 100 큐비트 이상의 초전도 양자 프로세서로, 펄스 수준의 제어가 가능하여 연구자들이 더 복잡한 양자 알고리즘을 테스트할 수 있는 환경을 제공합니다. * **AWS Lambda 매니지드 인스턴스**: 서버리스의 장점을 유지하면서도 메모리 집약적인 애플리케이션을 지원할 수 있도록 Lambda 인프라 옵션이 확장되어, 가벼운 워크로드를 넘어선 복잡한 계산 작업도 처리가 가능해졌습니다. 성공적인 AI 운영을 위해서는 도입 초기부터 **IAM 태그를 활용한 비용 할당 정책**을 수립하는 것이 권장됩니다. 또한, Amazon Bedrock에서 사용 중인 파운데이션 모델의 **생명주기(Lifecycle)** 문서를 정기적으로 확인하여, 모델 업데이트 및 단종 계획에 따른 서비스 중단 위험을 사전에 방지하시기 바랍니다.

aws원문

Amazon Bedrock Guardrails, 중앙 집중식 제어 및 관리를 통한 교차 계정 보호 기능 지원 | Amazon Web Services (새 탭에서 열림)

Amazon Bedrock Guardrails에서 조직 전체의 여러 AWS 계정에 걸쳐 보안 제어 기능을 중앙 집중식으로 관리하고 강제할 수 있는 '교차 계정 보호(cross-account safeguards)' 기능이 정식 출시되었습니다. 이 기능을 통해 관리자는 단일 정책으로 모든 계정과 생성형 AI 애플리케이션에 일관된 안전 가이드라인을 적용하여 거버넌스를 강화하고 보안 팀의 운영 부담을 획기적으로 줄일 수 있습니다. 결과적으로 개별 계정의 설정을 일일이 확인하지 않고도 조직의 책임감 있는 AI(Responsible AI) 요건을 효과적으로 충족할 수 있게 되었습니다. **조직 및 계정 단위의 중앙 집중식 제어** * **조직 수준 강제:** AWS Organizations의 관리 계정에서 단일 가이드라인을 설정하여 조직 전체, 특정 조직 단위(OU), 또는 개별 계정에서 발생하는 모든 Amazon Bedrock 모델 호출에 보안 필터를 자동 적용합니다. * **계정 수준 강제:** 특정 AWS 계정 내에서 이루어지는 모든 추론 API 호출에 대해 보호 조치를 일괄 적용하도록 구성할 수 있습니다. * **유연한 계층 구조:** 조직 전체의 공통 가드레일을 적용하면서도, 필요에 따라 특정 사용 사례나 애플리케이션에 맞는 계정별 추가 제어 기능을 병행하여 운용할 수 있습니다. **정교한 가드레일 설정 및 적용 옵션** * **모델 선택적 적용:** 중앙에서 추론에 사용할 특정 모델을 포함(Include)하거나 제외(Exclude)하도록 설정하여 관리 효율성을 높였습니다. * **콘텐츠 가드링 모드(Content Guarding):** * **포괄적 모드(Comprehensive):** 호출자의 태그 지정 여부와 관계없이 모든 시스템 프롬프트와 사용자 입력에 가드레일을 강제 적용하는 안전한 기본 방식입니다. * **선택적 모드(Selective):** 호출자가 태그를 지정한 특정 부분에만 가드레일을 적용하여 불필요한 처리를 줄이고 효율성을 높이는 방식입니다. * **변경 불가성 보장:** 가드레일 설정 시 특정 버전을 지정하여 생성함으로써, 하위 멤버 계정에서 보호 조치 내용을 임의로 수정하거나 우회할 수 없도록 보장합니다. **구현 방법 및 기술적 디테일** * **통합 관리 인터페이스:** Amazon Bedrock 콘솔이나 AWS Organizations 정책 메뉴를 통해 관리할 수 있으며, 가드레일 ARN과 버전을 지정한 'Bedrock 정책'을 대상 계정에 연결하는 방식으로 작동합니다. * **지원 API:** `InvokeModel`, `InvokeModelWithResponseStream`, `Converse`, `ConverseStream` 등 Amazon Bedrock의 주요 추론 API 호출 시 가드레일이 자동으로 개입합니다. * **검증 및 모니터링:** 멤버 계정에서 현재 강제 적용 중인 조직 수준 가드레일을 직접 확인할 수 있으며, API 응답에 포함된 가드레일 평가 정보를 통해 정상 작동 여부를 테스트할 수 있습니다. **실무 적용 시 유의 사항** * **정확한 ARN 지정:** 정책 설정 시 가드레일 ARN을 잘못 입력하면 정책 위반으로 간주되어 해당 계정에서 Bedrock 모델 추론 자체가 불가능해질 수 있으므로 정확한 식별자 입력이 필수적입니다. * **기능 제한 사항:** 현재 교차 계정 보호 기능은 '자동화된 추론(Automated Reasoning)' 검사는 지원하지 않으므로 보안 설계 시 이를 고려해야 합니다. * **비용 및 지역:** 가드레일이 적용될 때마다 구성된 보호 조치에 따른 비용이 발생하며, Bedrock Guardrails가 사용 가능한 모든 AWS 리전(Commercial 및 GovCloud)에서 즉시 사용할 수 있습니다.

aws원문

AWS 주간 소식: Amazon Bedrock의 NVIDIA Nemotron 3 Super, Nova Forge SDK, Amazon Corretto 26 등(2026년 3월 23일) | Amazon Web Services (새 탭에서 열림)

AWS는 최근 NVIDIA Nemotron 3 Super 모델의 Amazon Bedrock 추가와 Nova Forge SDK 출시를 통해 생성형 AI 생태계를 대폭 확장하고, 엔터프라이즈급 AI 맞춤화 기능을 강화했습니다. 동시에 Amazon Redshift의 쿼리 성능을 최대 7배 향상시키고 Amazon EKS의 가용성 실효 수준(SLA)을 99.99%로 높이는 등 클라우드 인프라의 성능과 신뢰성 측면에서도 유의미한 진전을 이루었습니다. 이번 업데이트는 개발자 중심의 도구 개선과 고성능 워크로드 지원이라는 AWS의 핵심 전략을 잘 보여줍니다. **생성형 AI 모델 및 맞춤화 도구 확장** * **NVIDIA Nemotron 3 Super 출시:** Amazon Bedrock API를 통해 NVIDIA의 고성능 언어 모델인 Nemotron 3 Super를 사용할 수 있게 되었습니다. 텍스트 생성, 복잡한 추론, 요약, 코드 생성에 최적화되어 있으며 별도의 인프라 관리 없이 기존 워크플로우에 통합 가능합니다. * **Nova Forge SDK 도입:** 기업용 Nova 모델을 도메인 특화 데이터에 맞게 미세 조정(Fine-tuning)하고 배포할 수 있는 간소화된 수단을 제공하여 맞춤형 AI 솔루션 구축의 복잡성을 낮췄습니다. * **에이전트 정확도 향상:** Strands 에이전트 팀이 발표한 'Steering Hooks' 기법을 통해 AI 에이전트의 정확도를 100%까지 달성했으며, 이는 기존 프롬프트 엔지니어링보다 뛰어난 제어 능력을 보여줍니다. **데이터 분석 및 컴퓨팅 인프라 성능 고도화** * **Amazon Redshift 성능 개선:** 대시보드 및 ETL 워크로드에서 캐시되지 않은 새로운 쿼리의 실행 속도가 최대 7배 빨라졌습니다. 이는 쿼리 변동성이 큰 대화형 대시보드의 대기 시간을 획기적으로 줄여줍니다. * **Amazon EKS SLA 및 확장성 강화:** 프로비저닝된 컨트롤 플레인 클러스터의 SLA가 99.99%로 상향되었으며, 4XL 대비 처리 용량이 2배인 8XL 스케일링 티어를 도입하여 대규모 AI/ML 학습 및 데이터 처리 환경을 지원합니다. * **AWS Lambda 가용 영역(AZ) 메타데이터 지원:** 함수 호출 시 실행 중인 AZ 정보를 확인할 수 있게 되어, 지연 시간에 민감한 멀티 AZ 워크로드의 관찰 가능성과 문제 해결 능력이 향상되었습니다. **개발자 편의성 및 운영 효율성 증대** * **Amazon Corretto 26 정식 출시:** OpenJDK의 최신 장기 지원(LTS) 버전인 Corretto 26이 출시되어 최신 Java 기능과 보안 패치를 다양한 운영체제에서 무료로 사용할 수 있습니다. * **CloudWatch Logs HTTP 기반 로그 수집:** 커스텀 에이전트나 SDK 없이 표준 HTTP 엔드포인트를 통해 로그를 직접 전송할 수 있게 되어 중앙 집중식 로그 관리 장벽이 낮아졌습니다. * **학생용 Kiro 지원:** 미래의 개발자들이 AI 기반 개발 도구를 무료로 경험할 수 있도록 Kiro 서비스를 학생들에게 개방했습니다. 이번 업데이트를 통해 엔터프라이즈 환경에서는 Nova Forge SDK를 활용한 도메인 특화 AI 모델 구축을 검토해 볼 가치가 있으며, 고가용성이 필요한 대규모 워크로드 운영 시 강화된 EKS 8XL 티어와 99.99% SLA를 적극 활용하는 것을 추천합니다. 또한 2026년 4월부터 시작되는 파리, 런던 등 전 세계 AWS 서밋 일정을 확인하여 최신 기술 트렌드를 직접 확인하시기 바랍니다.

aws원문

AWS 주간 소식: Amazon (새 탭에서 열림)

이번 주 AWS는 헬스케어 전용 AI 에이전트인 Amazon Connect Health의 정식 출시와 함께 Amazon Bedrock을 활용한 보안 및 개발 편의성 강화에 중점을 두었습니다. 인프라 측면에서는 VPC 암호화 제어의 유료화 전환과 데이터베이스 예약 플랜의 지원 범위 확대 등 운영 효율과 비용 최적화를 위한 실질적인 업데이트가 이루어졌습니다. 전 세계적으로 개최된 JAWS Days 2026과 케냐의 커뮤니티 이벤트를 통해 AI 기반 개발 팀 구축과 클라우드 네이티브 엔지니어링에 대한 뜨거운 관심을 확인할 수 있었습니다. **AI 에이전트 및 헬스케어 특화 서비스** - **Amazon Connect Health 정식 출시**: 환자 인증, 예약 관리, 환자 통찰력 제공, 진료 문서화 및 의료 코딩을 지원하는 5가지 전용 AI 에이전트를 선보였습니다. HIPAA를 준수하며 기존 임상 워크플로에 수일 내로 배포가 가능합니다. - **Amazon Bedrock AgentCore 정책 지원**: 에이전트 코드 외부에서 도구 간 상호작용을 중앙 집중식으로 제어할 수 있습니다. 자연어로 정의된 보안 규칙은 AWS의 오픈소스 정책 언어인 Cedar로 자동 변환되어 적용됩니다. - **Lightsail 기반 OpenClaw 도입**: 사용자의 클라우드 인프라에 프라이빗 자율 AI 에이전트를 원클릭 HTTPS 및 기기 페어링 인증을 통해 안전하게 배포하고 Slack이나 Discord 등에 연결할 수 있습니다. **인프라 보안 및 비용 관리 업데이트** - **VPC 암호화 제어 유료화**: 2026년 3월 1일부터 프리뷰 기간이 종료되어 유료로 전환됩니다. 리전 내외의 모든 트래픽 암호화를 모니터링하거나 강제할 수 있는 기능을 제공합니다. - **데이터베이스 Savings Plans 확대**: Amazon OpenSearch 서비스 및 Neptune Analytics가 지원 대상에 추가되어, 1년 약정 시 최대 35%의 비용을 절감할 수 있게 되었습니다. - **콘솔 내 IAM 역할 생성 간소화**: EC2, Lambda, EKS, Glue 등 주요 서비스의 워크플로 내에서 IAM 콘솔로 이동하지 않고도 즉시 역할을 생성하고 구성할 수 있는 패널이 추가되었습니다. **개발자 경험 및 운영 자동화** - **Elastic Beanstalk AI 분석 기능**: 환경 상태가 악화될 경우 Amazon Bedrock이 로그와 인스턴스 상태를 분석하여 단계별 트러블슈팅 권장 사항을 제공합니다. - **GameLift 서버 DDoS 보호**: 추가 비용 없이 릴레이 네트워크를 통해 클라이언트 트래픽을 인증하고 플레이어당 트래픽 제한을 설정하여 멀티플레이어 게임을 공격으로부터 보호합니다. - **Lambda 지속성 함수 개발 지원**: AI 에이전트 기반 개발 도구인 'Kiro'를 통해 재실행 모델, 에러 처리, 동시 실행 패턴 등 복잡한 워크플로 개발에 필요한 가이드를 동적으로 제공받을 수 있습니다. 이번 업데이트를 통해 AWS는 AI를 단순한 모델 제공을 넘어 의료 현장의 실무나 인프라 장애 조치와 같은 구체적인 운영 영역에 깊숙이 통합하고 있음을 보여줍니다. 특히 보안 정책을 자연어로 관리하거나 인프라 진단에 AI를 활용하는 기능들은 운영 부담을 크게 줄여줄 것으로 기대되므로, 현재 운영 중인 서비스의 효율성을 높이기 위해 이러한 도구들을 적극적으로 검토해 보시길 권장합니다.

aws원문

Amazon Lightsail에서 자율 프라이 (새 탭에서 열림)

Amazon Lightsail에서 자율형 프라이빗 AI 에이전트인 OpenClaw를 정식으로 지원하며, 복잡한 설치 과정 없이 클릭 몇 번만으로 나만의 디지털 비서를 구축할 수 있게 되었습니다. OpenClaw는 사용자의 브라우저와 연동되어 메시징 앱 연결, 웹 브라우징, 파일 관리 등 단순한 질의응답 이상의 능동적인 태스크를 수행합니다. 특히 Amazon Bedrock이 기본 모델 공급자로 사전 구성되어 있어, 별도의 서버 설정 없이도 즉시 강력한 AI 기능을 활용할 수 있다는 것이 큰 장점입니다. ### OpenClaw와 Amazon Lightsail의 결합 * **자율형 프라이빗 AI 에이전트:** OpenClaw는 단순 챗봇을 넘어 이메일 관리, 웹 서핑, 파일 정리 등 실제 컴퓨터 작업을 대신 수행하는 오픈소스 디지털 비서입니다. * **손쉬운 배포 환경:** 기존에는 개인이 직접 설치하거나 EC2에 구성하는 과정이 까다로웠으나, 이제 Lightsail의 'Blueprints' 메뉴에서 OpenClaw를 선택하는 것만으로 자동 최적화된 인스턴스를 생성할 수 있습니다. * **다양한 채널 확장성:** 브라우저뿐만 아니라 WhatsApp, Discord, Telegram 등 주요 메시징 앱과 연결하여 모바일 환경에서도 AI 에이전트에게 명령을 내릴 수 있습니다. ### 설치 및 보안 브라우저 페어링 과정 * **인스턴스 사양 및 생성:** 최적의 성능을 위해 4GB 이상의 메모리 플랜을 권장하며, AWS 리전과 플랫폼(Linux/Unix)을 선택한 후 OpenClaw 청사진으로 인스턴스를 생성합니다. * **보안 연결(Pairing):** 대시보드 접근을 위해 브라우저와 인스턴스를 안전하게 연결해야 합니다. Lightsail의 SSH 터미널을 통해 생성된 대시보드 URL과 보안 액세스 토큰(Gateway Token)을 확인하여 브라우저에 등록합니다. * **장치 승인:** 터미널 창에서 페어링 요청에 대해 승인('y' 및 'a' 입력) 절차를 거치면 브라우저와 OpenClaw 인스턴스 간의 보안 연결이 완료됩니다. ### Amazon Bedrock 기반의 AI 기능 활성화 * **기본 모델 공급자:** OpenClaw 인스턴스는 Amazon Bedrock을 기본 모델로 사용하도록 사전 설정되어 있습니다. * **IAM 권한 설정:** Bedrock API에 접근하기 위해 AWS CloudShell에서 제공되는 전용 스크립트를 실행해야 하며, 이를 통해 인스턴스에 필요한 IAM 역할(Role)과 정책이 자동으로 구성됩니다. * **유연한 모델 활용:** Bedrock을 통해 제공되는 Anthropic Claude나 Cohere 등 다양한 타사 모델을 선택하여 목적에 맞는 성능을 구현할 수 있습니다. ### 운영 고려 사항: 비용 및 보안 * **비용 구조:** Lightsail 인스턴스에 대한 시간당 요금과 Amazon Bedrock 사용량에 따른 토큰 기반 비용이 별도로 발생합니다. 타사 모델 사용 시 추가 소프트웨어 비용이 발생할 수 있음을 유의해야 합니다. * **권한 제어:** 인스턴스에 부여된 IAM 권한을 커스터마이징할 수 있으나, 권한을 과도하게 제한할 경우 AI의 응답 생성이 중단될 수 있으므로 주의가 필요합니다. * **보안 유지:** 게이트웨이 인증 토큰은 비밀번호와 같으므로 외부에 노출되지 않도록 주의해야 하며, 주기적인 토큰 교체와 환경 변수 파일을 통한 관리가 권장됩니다. 나만의 안전한 AI 비서를 구축하고 싶다면 Amazon Lightsail의 OpenClaw를 활용해 보시기 바랍니다. 초기 설정 시 4GB 메모리 플랜을 선택하고, 제공되는 스크립트를 통해 Bedrock 권한 설정을 완료하는 것만으로도 강력한 자율형 에이전트 환경을 경험할 수 있습니다.

aws원문

AWS 주간 요약: OpenAI 파트너십, AWS Elemental Inference, Strands Labs 등 (2026년 3월 2일) | 아마존 웹 서비스 (새 탭에서 열림)

AWS와 OpenAI의 대규모 전략적 파트너십 체결을 중심으로, 2026년 AWS는 기업들이 생성형 AI 실험 단계를 넘어 실제 비즈니스 가치를 창출할 수 있도록 지원하는 AI-DLC(AI-Driven Lifecycle) 프레임워크와 에이전트 중심의 기술 생태계를 강화하고 있습니다. 이번 파트너십을 통해 Amazon Bedrock에 OpenAI 모델 기반의 상태 유지 런타임 환경이 도입되며, AWS 전용 가속기인 Trainium 칩의 대규모 공급과 함께 보안, 미디어 처리, 인프라 관리 전반에 걸친 지능형 자동화 서비스들이 대거 출시되었습니다. **Amazon과 OpenAI의 전략적 파트너십 및 기술 통합** * **대규모 투자 및 독점 공급:** Amazon은 OpenAI에 총 500억 달러를 투자하며, AWS는 OpenAI Frontier 모델의 독점적 제3자 클라우드 배포처로서 기업용 에이전트 구축 및 관리를 지원합니다. * **Stateful Runtime Environment:** Amazon Bedrock 내에 OpenAI 모델을 기반으로 한 '상태 유지 런타임'을 구축하여, 개발자가 컨텍스트를 유지하고 다양한 소프트웨어 도구 및 데이터 소스에 걸쳐 작업을 수행할 수 있도록 합니다. * **커스텀 실리콘 협력:** OpenAI는 향후 8년 동안 AWS의 차세대 AI 칩인 Trainium3 및 Trainium4를 포함하여 약 2기가와트(GW) 규모의 연산 용량을 사용하기로 합의했습니다. **생성형 AI 에이전트 및 개발 생산성 강화** * **Amazon Bedrock Projects API:** OpenAI 호환 API를 사용하여 생성형 AI 워크로드를 애플리케이션 단위로 격리하고, 액세스 제어 및 비용 추적, 관측성을 개선할 수 있습니다. * **Strands Labs 신설:** 에이전트 중심의 AI 프로젝트를 실험하기 위한 별도의 조직을 구성하고 Robots, AI Functions 등 실험적 프로젝트를 오픈소스로 공개했습니다. * **Amazon Location Service LLM Context:** 위치 기반 기능을 구현할 때 AI 에이전트(Claude Code 등)가 활용할 수 있는 최적화된 컨텍스트를 제공하여 개발 속도와 정확도를 높였습니다. **미디어 처리 및 보안 운영의 자동화** * **AWS Elemental Inference:** AI를 활용해 라이브 및 주문형 비디오를 틱톡, 인스타그램 릴스용 세로 형식으로 자동 크롭하며, 6~10초의 짧은 지연 시간 내에 하이라이트 클립을 추출합니다. * **AWS Security Hub Extended:** CrowdStrike, Okta 등 주요 보안 파트너 솔루션을 AWS 통합 빌링과 사전 협의된 가격으로 손쉽게 배포 및 통합 운영할 수 있는 풀스택 보안 서비스를 제공합니다. * **AWS AppConfig & New Relic 통합:** 기능 플래그(Feature Flag) 배포 시 New Relic의 워크플로 자동화와 연동하여 이상 감지 시 즉각적인 지능형 롤백을 수행, 장애 대응 시간을 초 단위로 단축합니다. **성공적인 AI 도입을 위한 실무적 제언** 단순한 AI 기술 실험을 넘어 실제 운영 환경에 적용하려는 기업은 AWS가 제시하는 **AI-DLC(AI-Driven Lifecycle) 프레임워크**를 적극 활용할 것을 권장합니다. 특히 에이전트 기반 시스템 구축 시 발생할 수 있는 환각 현상을 줄이기 위해 단순 RAG 방식과 GraphRAG 방식을 비교 분석하고, 새롭게 오픈소스화된 EKS Node Monitoring Agent 등을 통해 인프라 가시성을 확보하는 것이 중요합니다.