human-centered-ai

2 개의 포스트

google4분 읽기큐레이션 요약

AI가 사용자의 피부 질환 이해를 돕는 방법에 대한 연구

인터넷과 AI가 피부 질환 정보를 찾는 데 도움을 주지만, 정보를 이해하고 적절한 다음 행동을 결정하는 일은 여전히 어렵다. Google Research는 피부 질환 후보를 제시하는 AI가 일반인의 질환명 파악 능력과 검색 만족도를 크게 높인다는 점을 확인했지만, 병원 방문 시점 등 안전한 후속 조치 판단에는 효과가 제한적이라고 밝혔다. 따라서 피부과 AI는 진단 보조뿐 아니라 사용자의 의사결정을 지원하는 인간 중심 설계가 필요하다. ## 피부 건강 정보에서 인간 중심 연구가 필요한 이유 - 성인의 절반 이상이 인터넷으로 건강 정보를 찾고, 약 3분의 1은 AI를 활용한다. - 정보에 접근할 수 있어도 의학 용어를 모르거나 검색 결과를 잘못 해석할 수 있다. - 예: “다리에 빨간 점”이라는 증상을 보고도 실제 검색어인 “촉지성 자반(palpable purpura)”을 알기 어렵다. - 기존 연구에서는 인터넷 검색으로 질환 식별 능력은 향상될 수 있지만, 이후 어떤 행동을 해야 하는지 판단하는 능력은 반드시 좋아지지 않는 것으로 나타났다. - Google Research는 감별진단 AI 모델, 일반화 검증, SCIN 데이터셋 등을 개발해 왔으며, 궁극적으로는 피부 고민이 있는 사람들이 더 나은 결정을 내리도록 돕는 것을 목표로 삼았다. ## 대규모 실험: AI가 질환명 파악에 미치는 영향 JAMA Dermatology에 게재된 연구에서는 2,345명의 참가자에게 이미지와 병력 정보가 포함된 익명 피부 질환 사례를 제시하고, 자신의 사례라고 가정해 조사하도록 했다. - 참가자는 세 집단으로 무작위 배정됐다. - **일반 검색 대조군**: 기존 텍스트 기반 웹 검색 도구 사용 - **AI 집단**: AI가 예측한 3~7개의 질환 후보를 카드 형태로 제시하고, 각 질환의 이미지·증상·치료 정보를 제공 - **‘Wizard of Oz’ 집단**: 동일한 인터페이스를 사용하지만, AI 예측 대신 피부과 전문의 패널이 정한 실제 감별진단을 제시 - AI 도구는 확정 진단을 내리기보다 이미지와 가능한 질환을 연결해 정보를 찾기 쉽게 하는 방식으로 설계됐다. - AI 집단에서는 62% 이상이 질환명을 추측하려 했으며, 일반 검색 집단의 41%보다 높았다. - 질환명 추측 정확도는 다음과 같았다. - 일반 검색 집단: 8% - 일반 AI 집단: 23% - 전문의 감별진단을 제공한 집단: 36% - AI 사용자는 자신의 추측에 더 큰 자신감을 보였고, 검색 결과와 검색에 걸린 시간에 대한 만족도도 높았다. - 다만 전문의 감별진단을 그대로 제공한 경우에도 정확도가 완벽하지 않아, 후보 질환을 보여주는 것만으로 사용자의 이해가 완전해지는 것은 아니었다. ## 질환 식별과 다음 행동 판단은 별개의 문제 연구진은 AI가 지나치게 지시적이거나 진단적인 도구가 되지 않도록 설계했다. - 치료 및 질환 정보는 피부과 전문의가 권위 있는 자료를 바탕으로 작성했다. - 그러나 정보는 해당 질환의 일반적인 설명에 기반했으며, 개별 사례의 심각도에 맞춰 개인화되지는 않았다. - 참가자들은 다음과 같은 판단에서 여전히 어려움을 겪었다. - 집에서 관리해도 되는지 - 일반 진료를 예약해야 하는지 - 긴급하게 병원을 방문해야 하는지 - 다음 행동 판단의 정확도는 전문의 감별진단을 제공한 집단에서만 소폭 높아졌다. - 전문의 감별진단 집단: 63.5% - 일반 검색 대조군: 60% - 일반 AI 집단은 통계적으로 유의미한 개선을 보이지 않았다. - 오히려 일반 AI 집단은 피부과 전문의가 판단한 것보다 덜 긴급한 행동을 제안하는 비율이 다소 높았다. - AI 집단: 30% - 대조군: 27% - 이는 가능한 질환명을 알려주는 것만으로는 안전한 의료 결정을 보장할 수 없으며, 위험 신호와 긴급도를 명확히 안내하는 기능이 필요하다는 점을 보여준다. ## 실제 사용자와 지역사회를 대상으로 한 질적 연구 연구진은 통제된 설문만으로는 사람들이 자신의 피부 문제에 AI를 어떻게 적용하는지 충분히 알기 어렵다고 보고, 실제 피부 고민이 있는 지역사회 구성원을 대상으로 별도의 연구를 진행했다. - ACM CHI 학회에 발표된 연구는 Stanford Healthcare AI Applied Research Team, Santa Clara Family Health Plan과 공동으로 수행됐다. - 연구 대상 지역사회에는 의료 안전망인 Medi-Cal에 의존하는 사람들이 다수 포함됐다. - 참가자들은 실제 피부 고민을 가진 다양한 배경의 사람들로 구성됐다. - AI 피부 애플리케이션을 실제 환경에서 사용하게 하면서 다음을 살폈다. - 사용자가 AI 정보를 어떻게 해석하는지 - 자신의 증상과 AI가 제시한 정보를 어떻게 연결하는지 - 정보가 의료 이용이나 의사결정에 어떤 영향을 주는지 - 참가자들이 주로 사용하는 언어가 네 가지였기 때문에 애플리케이션을 각 언어로 번역했다. - 해당 언어에 능통한 자원봉사자나 직원도 참여해 의사소통을 지원함으로써, 다양한 언어권 사용자에게 적합한 설계를 연구하려 했다. 피부과 AI는 질환 후보를 빠르게 찾고 의학 정보를 이해하는 데 유용하지만, 그 결과를 곧바로 진단이나 치료 결정으로 받아들여서는 안 된다. 실제 서비스에서는 긴급 증상 안내, 불확실성 표시, 개인의 증상과 심각도를 반영한 후속 조치 안내, 의료진 상담 연결 기능을 함께 제공하는 것이 중요하다.

원문 읽기(새 탭에서 열림)
line원문

IUI 2025 참관기: AI의 지속성과 인간 중심의 AI에 대해서 (새 탭에서 열림)

IUI(Intelligent User Interfaces) 2025 학회에서는 단순히 기술적 성능이 뛰어난 AI를 넘어, 인간의 능력을 증강하고 윤리적 책임을 존중하는 '인간 중심의 AI(Human-Centered AI)'가 핵심 화두로 다뤄졌습니다. 전문가들은 AI가 인간의 인지와 현실을 어떻게 재설계할 것인지, 그리고 복잡한 모델을 사용자가 어떻게 신뢰하고 통제할 수 있을지에 대한 실천적인 방법론을 제시했습니다. 결론적으로 미래의 AI는 독립적인 자동화 도구가 아니라, 인간과 상호작용하며 함께 성장하고 사회적 맥락 안에서 투명하게 소통하는 협력적 지능으로 진화해야 함을 강조했습니다. **리얼리티 디자인: 인터페이스를 넘어 현실을 설계하는 AI** * HCI(인간-컴퓨터 상호작용) 연구의 범위를 단순한 화면 속 인터페이스에서 인간의 삶이 이루어지는 '현실 자체'로 확장해야 한다는 '리얼리티 디자인' 개념이 제시되었습니다. * AI와 센서, XR 기술을 결합하여 인간의 기억을 기록 및 재구성하거나, 특정 음성을 선택적으로 청취하고 동작을 슬로 모션으로 지각하는 등 인간의 감각과 인지 능력을 물리적으로 증강하는 연구 사례들이 소개되었습니다. * 다만, 기술이 인간의 사고와 학습 의지를 약화시켜 '인지적 퇴화'를 초래할 수 있다는 점이 경고되었으며, 기술과 인간이 서로 영향을 주고받는 순환적 관계임을 고려한 설계가 필요합니다. **인간 중심의 AI 투명성: 사회기술적 간극 해소** * 기존의 기술 중심적 설명 가능성(XAI)에서 벗어나, 사용자가 실제 맥락에서 이해하고 신뢰할 수 있는 '사회기술적(socio-technical)' 관점의 투명성 확보가 강조되었습니다. * 투명성을 구현하기 위한 구체적 방법론으로 확정적이지 않은 결과를 명확히 전달하는 '불확실성 커뮤니케이션', 조건 변화에 따른 결과 차이를 보여주는 '반사실적 설명', 사용자가 피드백을 통해 모델을 조정하는 '상호작용 기반 투명성'이 제시되었습니다. * LLM 시대의 투명성은 단순한 정보 공개를 넘어 모델 카드(Model Card)를 통한 데이터/개발 배경 공유, 안전성 및 리스크 평가 결과 포함, 그리고 사용자가 직접 통제권을 가질 수 있는 수단을 함께 제공하는 방향으로 나아가야 합니다. **인터랙티브 머신러닝: 사용자와 함께 성장하는 모델** * AI를 고정된 데이터를 학습하는 정적 도구로 보지 않고, 사용자가 모델의 오류를 수정하고 그 피드백이 다시 학습에 반영되는 '인간 참여형(Human-in-the-loop)' 루프의 중요성이 재조명되었습니다. * 이 방식은 교육 도구에서 학생들이 데이터를 조작하며 학습 원리를 깨우치게 하거나, 연구 현장에서 대규모 데이터를 분석할 때 인간의 직관을 결합하는 등 다양한 실무 분야에서 인용되고 있습니다. * 좋은 AI의 기준은 독립적인 성능 수치보다 사용자와의 지속적인 상호작용을 통해 얼마나 유연하게 적응하고 발전할 수 있는지에 달려 있습니다. **전문가 협업 시스템: 상담 분석을 돕는 AI** * 아동 상담 분석과 같이 고도의 전문성이 필요한 영역에서 AI가 상담사의 녹취 및 전사 작업을 보조하고, 상담사가 AI의 결과물을 손쉽게 편집 및 교정할 수 있는 협업 시스템 연구가 발표되었습니다. * 이는 AI가 인간의 일자리를 대체하는 것이 아니라, 번거로운 작업을 효율화함으로써 전문가가 본연의 가치 있는 업무에 집중할 수 있도록 돕는 실질적인 협업 모델의 예시를 보여줍니다. **실용적 제언** AI 시스템을 설계할 때 단순히 정확도를 높이는 데 그치지 말고, 사용자가 시스템의 판단 근거를 납득할 수 있는 '설명 수단'과 잘못된 결과를 바로잡을 수 있는 '통제 수단'을 반드시 세트로 설계해야 합니다. 특히 고위험군 서비스를 개발할 때는 모델의 불확실성을 시각적·언어적으로 친절하게 전달하여 사용자가 적절한 수준의 신뢰를 형성하도록 유도하는 것이 중요합니다.