web-search

3 개의 포스트

aws

2026 뉴욕 AWS 서밋의 주요 발표 | Amazon Web Services (새 탭에서 열림)

AWS Summit New York 2026의 핵심은 AI 에이전트를 더 쉽게 구축하고, 기업 데이터와 웹 지식을 연결하며, 운영·보안·개발 전반을 자동화하는 것이다. AWS는 Bedrock AgentCore, 보안·DevOps 에이전트, Kiro, Amazon Quick 등을 통해 에이전트의 생성부터 배포, 관리, 지속적인 개선까지 지원하는 기능을 공개했다. 또한 S3 객체에 직접 쿼리 가능한 맥락 정보를 저장하는 기능과 AI 봇 대상 콘텐츠 과금 기능도 발표했다. ## 기업 지식과 웹 검색을 활용하는 에이전트 - **Amazon Bedrock Managed Knowledge Base** - 기업용 RAG 파이프라인을 관리형 서비스로 구축할 수 있다. - 네이티브 데이터 커넥터와 다양한 형식의 데이터를 자동 처리하는 **Smart Parsing**을 제공한다. - 복잡한 다단계 질문을 처리하는 **Agentic Retriever**를 지원한다. - Bedrock AgentCore Gateway와 통합되어 인프라 관리 부담을 줄인다. - **Amazon Bedrock AgentCore Web Search** - AI 에이전트가 최신 웹 정보를 검색하고 출처를 포함해 답변할 수 있다. - 고객의 보안 AWS 환경에서 데이터가 외부로 유출되지 않도록 설계됐다. - 개발자가 별도의 검색 인프라를 직접 구축·운영하지 않아도 된다. - **AWS Context** - 기존 데이터 간 관계를 자동으로 분석해 지식 그래프로 구성하는 서비스다. - 에이전트가 실행 시점에 조직의 데이터 관계, 업무 규칙, 도메인 지식을 검색할 수 있도록 한다. - 거버넌스가 적용된 기업 데이터를 에이전트가 활용하는 기반으로 소개됐다. ## AI 에이전트에 대한 통제와 운영 - **Bedrock AgentCore의 새로운 기능** - 조직 내부 지식, 웹 정보, 유료 지식 소스를 에이전트에 연결할 수 있다. - 프로덕션 환경에서 발생한 문제를 찾고 수정하는 기능을 제공한다. - 에이전트의 능력이 확장되어도 적용 가능한 통제 체계를 구축할 수 있다. - **Amazon Bedrock AgentCore Harness 정식 출시** - 오케스트레이션 루프를 직접 코딩하지 않고도 프로덕션 수준의 에이전트를 구축·실행할 수 있다. - 설정 파일에서 모델, 도구, 스킬, 지침을 정의하는 방식이다. - 에이전트 개발 시간을 단축하는 데 초점을 둔다. - **AWS WAF의 AI 트래픽 과금** - 콘텐츠 제공자가 콘텐츠와 API에 접근하는 AI 봇 및 에이전트에 요금을 부과할 수 있다. - 접근량을 측정하고, 제3자 결제 사업자를 통한 결제를 지원한다. - AWS 엣지에서 범위가 제한된 접근 권한을 직접 부여할 수 있다. ## 머신 속도의 애플리케이션 보안 - **AWS Continuum** - 여러 환경에서 수집한 코드 취약점 정보를 통합한다. - 비즈니스 영향도를 기준으로 취약점을 우선순위화한다. - 실제 악용 가능성을 검증하고, 조직의 기존 프로세스를 통해 수정까지 연결한다. - 코드 취약점 기능은 제한된 미리보기로 제공된다. - **AWS Security Agent** - 애플리케이션 전체 맥락을 분석해 위협 모델을 생성한다. - STRIDE 프레임워크를 활용해 위협과 권장 완화책을 제시한다. - 주요 Git 플랫폼의 풀 리퀘스트 코드 검사와 자동 수정 흐름을 지원한다. - Kiro Power, Claude Code 플러그인, MCP를 통한 IDE 연동도 제공한다. ## 개발과 릴리스 자동화 - **Kiro for iOS** - iPhone에서 Kiro 세션을 시작하고 모니터링할 수 있다. - 작업 완료 후 변경 diff를 검토하고 수정 사항을 승인할 수 있다. - 노트북을 계속 켜두지 않아도 개발 작업을 원격으로 관리할 수 있다. - **AWS DevOps Agent의 릴리스 관리** - 프로덕션 배포 전 코드 변경 사항의 릴리스 준비 상태를 검토한다. - 자연어로 정의한 조직의 기준에 따라 변경 사항을 검증한다. - 프로덕션과 유사한 환경에서 변경 사항별 테스트를 자동 실행한다. - **AWS Transform의 지속적 현대화** - 설정 가능한 기준에 따라 코드 저장소를 지속적으로 분석한다. - 기술 부채와 현대화 대상을 수주가 아닌 수시간 내에 식별하는 것을 목표로 한다. - 우선순위가 정해진 문제에 대해 자동으로 수정 풀 리퀘스트를 생성할 수 있다. ## 업무를 수행하는 자율 에이전트 - **Amazon Quick 자율 에이전트** - 특정 전문성, 말투, 도구 접근 권한을 가진 백그라운드 에이전트를 만들 수 있다. - 금융 에이전트가 주문을 처리하거나, 영업 에이전트가 CRM·이메일·Slack을 모니터링할 수 있다. - 후속 연락 초안 작성, 위험 신호 표시, 다음 업무 추천 등을 자동 수행한다. - **새로운 Activity Feed** - 이메일, 메시지, 일정, 작업을 하나의 우선순위 기반 화면에 통합한다. - 사용자가 빠르게 답하는 메시지, 건너뛰는 대화, 업무상 자주 다루는 주제를 학습한다. - 개인의 업무 방식에 맞춰 중요한 활동을 선별한다. ## AI 에이전트를 위한 S3 메타데이터 - **Amazon S3 annotations** - S3 객체에 최대 1GB의 풍부하고 변경 가능한 맥락 정보를 직접 추가할 수 있다. - 저장된 정보는 쿼리 가능하므로 AI 에이전트가 객체의 의미와 관련 정보를 바로 탐색할 수 있다. - 별도의 메타데이터 시스템을 유지하지 않고도 대규모 데이터 처리와 자율 워크플로를 지원한다. 이번 발표는 AWS가 AI 에이전트를 단순한 대화형 기능이 아니라 지식 검색, 보안 대응, 코드 수정, 릴리스 검증, 업무 실행까지 담당하는 운영 시스템으로 확장하고 있음을 보여준다. 실제 도입 시에는 에이전트의 자율성보다 데이터 접근 권한, 비용 통제, 감사 로그, 사람의 승인 절차를 먼저 설계하는 것이 바람직하다.

aws

Amazon Bedrock AgentCore 웹 검색 출시 발표: AI 에이전트를 최신의 정확한 웹 지식으로 기반 강화하기 | Amazon Web Services (새 탭에서 열림)

Amazon Bedrock AgentCore의 Web Search가 정식 출시되어, AI 에이전트가 최신 웹 정보를 검색하고 출처와 함께 응답하도록 지원한다. 검색은 AWS 환경 내부에서 처리되므로 고객의 프롬프트와 검색 질의를 외부 검색 API 사업자에게 전송하지 않으며, 모델 학습 데이터 이후의 최신 정보도 안전하게 활용할 수 있다. Amazon 웹 인덱스와 지식 그래프를 결합해 일반 웹 검색보다 정확하고 신뢰도 높은 근거 제공을 목표로 한다. ## 최신 웹 정보와 출처를 활용한 응답 - 에이전트가 자연어 검색 질의를 보내면 관련성이 높은 다음 정보를 반환한다. - 검색 결과 요약문(snippet) - 원문 URL - 문서 제목 - 발행일 - 에이전트는 반환된 검색 결과를 추론해 최신 사실에 근거한 답변이나 후속 작업을 수행할 수 있다. - 모델의 학습 시점 이후 발생한 사건과 정보를 반영할 수 있어, 시의성이 중요한 업무에 적합하다. ## Amazon 검색 인프라와 지식 그래프 결합 - Web Search는 Amazon의 검색 인프라를 기반으로 구축됐다. - Amazon 웹 인덱스뿐 아니라 구조화된 지식 그래프 데이터도 함께 사용하는 다중 소스 기반 검색 방식을 적용한다. - Amazon Knowledge Graph의 검증된 사실을 활용해 단순 키워드 검색보다 관련성과 정확도가 높은 결과를 제공한다. - Alexa+, Amazon Quick, Kiro 등에서 축적한 에이전트 검색 경험이 기반이 됐다. ## MCP 기반 Bedrock AgentCore Gateway 연동 - Web Search는 Bedrock AgentCore Gateway의 기본 제공 커넥터 타깃으로 제공된다. - Model Context Protocol(MCP)을 사용하므로 MCP를 지원하는 에이전트와 개발 도구에서 호출할 수 있다. - 사용자는 Gateway 생성 시 다음과 같이 Web Search를 추가할 수 있다. - 대상 프로토콜: MCP target - 대상 유형: Connectors - 사전 구성된 타깃: Web Search - 기존 Gateway의 상세 페이지에서도 Web Search 타깃을 추가할 수 있다. ## 설정 및 테스트 방법 - Bedrock AgentCore 콘솔에서 Web Search 도구 타깃이 포함된 Gateway를 생성한다. - Gateway URL이 생성되면 다음 방식으로 검색 도구를 호출할 수 있다. - API 요청 - AWS CLI - Python 코드 - MCP Python SDK - Strands MCP Client - MCP Inspector - MCP Inspector에서는 Gateway 리소스 URL에 연결한 뒤 Web Search 도구를 선택하고 검색어를 입력해 결과를 즉시 확인할 수 있다. - 콘솔의 **View invocation code** 영역에서 호출 예제 코드를 확인할 수 있다. ## 보안과 기업 거버넌스 - 검색 질의와 사용자 프롬프트를 AWS 외부의 검색 API 제공업체로 보내지 않고, 고객의 보안된 AWS 환경 내에서 처리할 수 있다. - 별도의 검색 인프라를 직접 구축하거나 외부 API 연동을 관리하지 않아도 된다. - 기업 정책에 맞춰 데이터 보호와 접근 통제를 유지하면서 외부 공개 정보와 내부 데이터를 함께 활용할 수 있다. - Benchling은 기관 내부 과학 데이터와 최신 학술 문헌을 결합해 연구 질문에 답하고 가설을 생성하는 데 활용하고 있다. - Gen Digital은 Norton Revamp에서 현재 온라인 동향을 반영한 콘텐츠 아이디어를 생성하는 데 사용하고 있다. ## 제공 지역과 비용 - 현재 미국 동부(버지니아 북부) 리전에서 정식 제공된다. - Web Search 자체는 추가 비용 없이 시작할 수 있다. - Gateway 사용에 따른 데이터 전송 요금은 별도로 부과된다. - 신규 AWS 고객은 최대 200달러의 프리 티어 크레딧을 받을 수 있다. 실제로 도입할 때는 먼저 MCP Inspector로 검색 결과의 품질과 출처 형식을 검증한 뒤, 에이전트 프롬프트에 “검색 결과의 출처와 발행일을 반드시 반영하라”는 규칙을 추가하는 것이 좋다. 이후 내부 데이터와 웹 검색 결과를 함께 사용하는 경우에는 권한 관리와 출처 추적 정책을 별도로 설계해야 한다.

figma

아무도 당신을 판단 (새 탭에서 열림)

Perplexity는 링크 목록을 보여주는 검색엔진이 아니라, 웹의 정보를 종합해 출처와 함께 답을 제공하는 ‘답변 엔진’을 지향한다. 목표는 사용자가 남의 시선을 의식하지 않고 무엇이든 질문하게 하며, 짧은 시간에 핵심을 이해한 뒤 더 깊은 호기심으로 나아가도록 돕는 것이다. 이를 위해 최신 웹 정보, 간결한 요약, 투명한 출처, 대화형 인터페이스를 결합한다. ## 호기심을 위한 지식 앱 - 공동 창업자 아라빈드 스리니바스는 어린 시절 위키피디아 링크를 따라가며 지식을 탐색하던 경험에서 Perplexity의 아이디어를 얻었다. - 백과사전이 종이책, CD·DVD, 위키피디아를 거쳐 Perplexity로 발전했다고 본다. - 사람들의 참여를 유도하는 방식이 반드시 짧은 영상이나 자극적인 콘텐츠일 필요는 없으며, 호기심 자체를 자극할 수 있다고 주장한다. - 누구나 판단받을 걱정 없이 질문할 수 있게 하는 것이 제품의 중요한 목표다. ## 두려움을 넘어선 창업 - 창업자들은 처음에 자신들의 질문에 답하기 위해 Slack 봇을 만들었다. - 투자 유치 방식 - 직원 건강보험 설정 등 실무적인 질문 - 제품이 유용했지만, 구글과 경쟁한다고 사람들이 비웃을까 봐 공개를 망설였다. - 투자자 냇 프리드먼은 “잃을 것이 없고, 최악의 결과도 현재보다 나은 진전”이라는 비대칭적 베팅의 관점을 제시했다. - 이 조언을 계기로 Perplexity는 ChatGPT 출시 직후 서비스를 공개했다. ## ChatGPT 이후의 차별화 - ChatGPT가 지식의 기준 시점과 환각 문제를 널리 인식시킨 상황에서, Perplexity는 답변뿐 아니라 근거 출처도 함께 제공하는 방향을 택했다. - 핵심 구성 요소는 다음과 같다. - 자연어 질문 이해 - 웹 검색 및 색인 - 대규모 언어 모델 - 여러 웹페이지의 정보 종합 - 답변별 출처와 각주 제공 - Perplexity는 “위키피디아와 대화형 채팅을 결합한 서비스”로 설명되며, 정보의 범위는 전체 인터넷으로 확장된다. ## 정보를 쉽게 전달하는 80/20 접근법 - 사용자가 모든 자료를 처음부터 끝까지 읽지 않아도 핵심적인 이해를 얻도록 하는 것이 목표다. - 책의 서론과 첫 장을 읽어 전체 가치의 상당 부분을 파악하는 방식처럼, Perplexity도 여러 웹페이지에서 중요한 내용을 추려 간결한 답변을 만든다. - 예를 들어 LLM을 이해할 때 전체 세부사항을 다 알기보다, 핵심 개념의 약 20%를 통해 전체 이해의 80%를 얻도록 돕는다. - 단순화하되 내용을 지나치게 축약하지 않고, 원문 출처를 확인할 수 있게 해 정보의 신뢰성과 깊이를 유지한다. ## 답변에서 새로운 질문으로 - 질문에 답한 뒤 관련 질문 세 가지를 제시해 사용자가 다음 탐색 단계로 자연스럽게 이동하도록 한다. - 창업자는 모든 사람이 본질적으로 호기심이 많지만 다음과 같은 이유로 질문을 충분히 발전시키지 못한다고 본다. - 호기심을 탐구할 동기가 부족함 - 무엇이 궁금한지 정확히 표현하기 어려움 - 좋은 질문을 만드는 능력이나 배경지식이 부족함 - 좋은 질문은 사용자의 지식 수준과 목적에 따라 달라진다. 같은 블랙홀 주제라도 일반 사용자와 물리학 박사에게 필요한 설명의 깊이는 다르다. - 따라서 제품은 사용자가 질문을 정확히 만들지 못했다고 탓하기보다, 사용자의 의도와 이해 수준에 맞춰 질문을 구체화하고 탐색을 지원해야 한다. ## 실용적인 시사점 Perplexity의 사례는 AI 검색 서비스가 단순히 더 많은 정보를 제공하는 것보다, **검증 가능한 답변을 적절한 깊이로 전달하고 다음 질문까지 설계하는 것**이 중요하다는 점을 보여준다. 지식 탐색 제품을 만들 때는 정확한 출처, 사용자 수준에 맞는 설명, 판단받지 않는 질문 환경, 후속 호기심을 유도하는 인터페이스를 함께 고려하는 것이 효과적이다.