데이터 · Judge 설정
Mock API의 메뉴/가게 데이터와 Judge 평가 기준을 관리합니다.
여기서 바꾼 값은 실제 API 호출 결과에 즉시 반영됩니다.
Judge 설정
사람이 직접 읽어야 판단할 수 있는 응답 품질을 Claude AI가 대신 평가합니다.
API 응답과 "이렇게 응답해야 한다"는 기준(Ground Truth)을 함께 넘겨주면, 정확도·완결성·엣지 대응 세 가지를 점수로 돌려줍니다.
기준을 바꾸면 같은 응답도 점수가 달라지기 때문에, Ground Truth를 얼마나 잘 정의하느냐가 핵심입니다.
통과 기준 점수
75점현재 버전 기준
현재 버전 기준
정확도33%
완결성33%
엣지 대응33%
claude-sonnet-4-6
메뉴
| ID | 이름 | 가격 | 재고 | 카테고리 |
|---|
가게
API 문서
Mock API 엔드포인트 및 시나리오 파라미터 확인
Swagger UI 열기