Caramel LabCaramel Lab
#

비전-언어 모델

1의 한국어 분석 — 최신순으로 정렬했어요

컴퓨터 과학발표 2025.06· 41최근 1년 41

의료 영상 비전-언어 파운데이션 모델

대규모 언어 모델과 비전-언어 모델(VLM)을 포함한 파운데이션 모델은 효율적이고 확장 가능하며 다중 모드 학습을 통해 인공지능 분야에 혁신을 가져왔습니다. 이러한 모델은 자기 지도 및 준 지도 학습의 발전을 활용하여 컴퓨터 비전과 자연어 처리를 통합함으로써 질병 분류, 분할, 교차 모드 검색, 자동 보고서 생성과 같은 복잡한 작업을 해결합니다. 의료 분야에서 파운데이션 모델은 다양한 의료 영상 모달리티 정보와 방사선 보고서 및 임상 기록의 텍스트 데이터를 결합하여 중요한 문제를 해결합니다. 이러한 통합은 진단 워크플로우를 간소화하고 정확도를 높이며 견고한 의사 결정을 가능하게 하는 도구 개발로 이어졌습니다. 본 리뷰는 2022년부터 2024년까지 의료 VLM의 최신 발전을 체계적으로 검토하며, 의료 영상 분야의 모달리티별 접근 방식과 맞춤형 응용에 중점을 둡니다. 주요 기여는 기존 모델을 분류하기 위한 구조화된 분류 체계, 훈련 및 평가에 필수적인 데이터셋에 대한 심층 분석, 그리고 실제 응용 사례 검토를 포함합니다. 이 연구는 또한 현재 진행 중인 과제를 다루고 의료 분야에서 파운데이션 모델의 접근성과 영향력을 높이기 위한 미래 방향을 제시합니다.

연구 트렌드로 돌아가기