For AI 개발
본문 바로가기

Computer Science/AI

For AI 개발

728x90
반응형

RAGAS를 이용한 RAG 검증/평가 - RAG 시스템 검증 가이드

 

RAGAS를 이용한 RAG 검증/평가 - RAG 시스템 검증 가이드

RAGAS FrameworkRAGAS는 RAG 시스템의 품질을 정량적으로 측정, 평가하기 위한 프레임워크이다.RAG를 만들었는데, 검색과 답변이 정상적으로 출력된다. 그런데 이 답변이 정말 정확한 답변인건지 정확

innovation123.tistory.com

 

https://bsssss.tistory.com/1621

[Langfuse] Evaluation : LLM-as-a-Judge

Langfuse Evaluation의 human annotation과 LLM-as-a-judge는 평가 방식(즉, ground truth(우리가 정한 정답)를 수집하거나 평가하는 방법)을 가리킵니다. 1. Human Annotation📌 개념사람이 직접 데이터를 보고 옳고 그름(혹은 점수)을 매기는 방식즉, 사람이 “정답”을 결정함 (Ground T...

 

728x90
반응형