—
설치 모델 / 평가 대상
AI PERFORMANCE LAB · LIVE
Ollama, PostgreSQL, 평가 문제와 벤치마크 결과를 서버의 실제 데이터에서 조회합니다.
설치 모델 / 평가 대상
문제 / 기준 결과 파일
Northwind 주문
확인 중
문제마다 전체 스키마를 함께 전달합니다. 실패한 문제는 기록하고 다음 문제를 계속 실행합니다.
한 번에 한 작업만 실행합니다. 브라우저를 닫아도 서버에서 계속 처리합니다. 오류 수정은 생성·SQL 실행 오류에만 적용하며 최초 정답과 수정 후 정답을 분리합니다.
설치 여부와 메모리 로드 상태는 Ollama API에서 실시간 조회합니다.
| 모델 | 실제 크기 | 역할 | 설치 | 로드 |
|---|
benchmark/results/*/summary.csv에서 읽습니다.
| 실행 ID | 모델 | 시도 | SQL 실행 | 정답 | 생성 시간 | 토큰/초 |
|---|
문제는 advanced.json, 반환 컬럼은 기준 CSV 헤더에서 읽습니다. 기준 SQL은 공개하지 않습니다.
문서를 불러오는 중입니다.