728x90
반응형
RAGAS를 이용한 RAG 검증/평가 - RAG 시스템 검증 가이드
RAGAS를 이용한 RAG 검증/평가 - RAG 시스템 검증 가이드
RAGAS FrameworkRAGAS는 RAG 시스템의 품질을 정량적으로 측정, 평가하기 위한 프레임워크이다.RAG를 만들었는데, 검색과 답변이 정상적으로 출력된다. 그런데 이 답변이 정말 정확한 답변인건지 정확
innovation123.tistory.com
https://bsssss.tistory.com/1621
[Langfuse] Evaluation : LLM-as-a-Judge
Langfuse Evaluation의 human annotation과 LLM-as-a-judge는 평가 방식(즉, ground truth(우리가 정한 정답)를 수집하거나 평가하는 방법)을 가리킵니다. 1. Human Annotation📌 개념사람이 직접 데이터를 보고 옳고 그름(혹은 점수)을 매기는 방식즉, 사람이 “정답”을 결정함 (Ground T...
728x90
반응형
'Computer Science > AI' 카테고리의 다른 글
| AI | Ollama란? 로컬에서 LLM을 실행하는 가장 쉬운 방법 (0) | 2026.04.01 |
|---|