프로젝트 배경
기존 RAG 챗봇의 검색·답변 품질을 정량 평가하고 공식 근거와 안전한 보류 흐름까지 확인할 수 있도록 사전 기획했습니다.
프로젝트 성과
다국어 평가 기준
4개 언어 평가셋과 검색·인용 품질 지표를 설계했습니다.
핵심 기능
진행 단계
기획
2026.09.
요구사항과 RAG 전 구간, 기준선 지표를 정리합니다.
프로젝트 상세
공식 근거 기반 RAG 챗봇의 검색 누락·오검색·인용 불일치를 진단하고 개선하는 전략 제안서입니다. 다국어 평가셋, hybrid retrieval, 보수적 보류, 회귀 테스트와 실행 산출물을 정리했습니다. *본 포트폴리오는 공고지원을 위해 사전 제작된 내용임을 알려드립니다. https://wishket-158150-rag-quality-improvement.pages.dev/







