검색 증강 생성(RAG)은 외부 지식을 통합하여 AI 생성 콘텐츠의 관련성을 높이고 환각 현상을 줄이지만, 신뢰성, 안전성, 프라이버시, 공정성, 설명 가능성, 책임성 측면에서 새로운 위험을 야기합니다. 이러한 문제들은 RAG 시스템의 전반적인 신뢰성에 영향을 미치며, 현재까지 이들을 통합적으로 다루는 프레임워크는 부족합니다.
본 연구는 신뢰할 수 있는 RAG 시스템 구축을 위한 포괄적인 로드맵을 제시하여 이러한 격차를 해소합니다. 신뢰성 관련 주요 도전 과제, 기존 해결책, 그리고 미래 연구 방향을 체계적으로 분석합니다. 특히 검색 및 생성 단계와 여섯 가지 신뢰성 차원 간의 상호작용을 중심으로 분야를 정리하고, 교차 차원 분석을 통해 시너지 효과와 상충 관계를 명확히 보여줍니다.
이 분석은 신뢰할 수 있는 RAG가 큰 영향을 미칠 수 있는 실제 응용 분야를 조명합니다. 본 연구는 실세계 AI 시스템에서 신뢰할 수 있는 RAG의 추가 연구와 도입을 장려하는 데 기여할 것입니다.
거대 언어 모델(LLM)은 방대한 파라미터 기반의 지식 저장 능력을 통해 다양한 분야에서 뛰어난 성능을 보였지만, 환각 현상, 지식 업데이트의 어려움, 특정 도메인 전문성 부족 등의 한계를 지닌다. 외부 지식 기반을 활용하여 LLM을 보강하는 검색 증강 생성(RAG)은 이러한 제약을 완화하는 효과적인 대안으로 부상했다.
본 연구는 자연어 처리(NLP) 분야의 RAG 기술을 체계적으로 검토하며, 특히 검색기(retriever)와 검색 융합(retrieval fusion) 방식에 초점을 맞춘다. 질의 기반, 로짓 기반, 잠재적, 파라미터 융합 등 새로운 검색 융합 분류 체계를 제시하고, 접근성, 효율성, 활용 사례를 기준으로 구조화된 비교 분석을 수행한다.
나아가 다양한 NLP 태스크에서의 RAG 적용 사례를 탐구하고, 평가 방법론 및 벤치마크의 한계를 논의한다. 지식 기반 업데이트 유무에 따른 훈련 패러다임을 분석하며, 산업 배포 시 고려사항과 보안, 효율성, 그래프 기반 검색 등 새롭게 부상하는 도전 과제 및 미래 연구 방향을 제시한다.
거대 언어 모델(LLM)은 자연어 처리 분야에 혁신을 가져왔지만, 편향에 취약하다는 중대한 문제가 있습니다. 본 종합 리뷰는 LLM 편향의 발생 원인부터 현재의 완화 전략까지 포괄적으로 탐구합니다.
편향을 내재적 및 외재적 범주로 나누고, 다양한 자연어 처리(NLP) 작업에서 나타나는 양상을 분석합니다. 또한, 데이터 수준, 모델 수준, 출력 수준 접근 방식을 포함한 다양한 편향 평가 방법을 비판적으로 검토하여 연구자들에게 견고한 편향 탐지 도구 키트를 제공합니다.
완화 전략은 모델 이전, 모델 내, 모델 이후 기술로 분류하여 효과와 한계를 조명합니다. 특히 헬스케어 및 형사 사법 시스템과 같은 실제 응용 분야에서 편향된 LLM이 야기할 수 있는 잠재적 피해를 강조하며 윤리적, 법적 함의를 논의합니다.
이 리뷰는 LLM 편향에 대한 현재 지식을 종합함으로써 공정하고 책임감 있는 인공지능(AI) 시스템 개발 노력에 기여합니다. 본 연구는 LLM 편향을 이해하고 평가하며 완화하는 데 전념하는 연구자와 실무자에게 포괄적인 자료가 되어, 더욱 공평한 AI 기술 발전을 촉진할 것입니다.
거대 언어 모델(LLM)은 정적인 정보에 국한된다는 한계를 지닌다. 검색 증강 생성(RAG)은 정보 검색(IR) 기술과 딥러닝을 결합하여 LLM이 최신 외부 정보를 동적으로 통합할 수 있도록 함으로써 이러한 한계를 극복한다. 이 방법론은 주로 텍스트 영역에 초점을 맞추며, LLM이 생성하는 그럴듯하지만 부정확할 수 있는 응답에 대한 비용 효율적인 해결책을 제공하여 실제 데이터를 통해 출력의 정확성과 신뢰성을 향상시킨다.
RAG는 성능에 영향을 미칠 수 있는 여러 개념을 통합하며 복잡성이 증가하고 있다. 본 논문은 RAG 패러다임을 사전 검색, 검색, 사후 검색, 생성의 네 가지 범주로 체계화하여 검색 관점에서 상세한 시각을 제공한다. 또한 RAG의 작동 방식을 설명하고 주요 연구 분석을 통해 이 분야의 발전을 논의한다.
이 연구는 RAG에 대한 평가 방법을 소개하고, 당면 과제를 다루며 미래 연구 방향을 제시한다. 체계적인 프레임워크와 분류를 제공함으로써 RAG에 대한 기존 연구를 통합하고, 기술적 기반을 명확히 하며, LLM의 적응성과 응용 범위를 확장할 잠재력을 강조한다.