개요
Ko-AgentBench 리더보드의 평가 대상에 새로운 로컬 LLM 모델을 추가하고자 합니다.
한국어 이해력과 도구 호출 기능을 갖춘 모델들을 중심으로 벤치마크 확장을 제안합니다.
📊 현재 리더보드 대상 로컬 모델
✅ 추가 기준
- 한국어가 가능한 모델
- 로컬 환경에서 구동 가능한 모델 (HuggingFace 등에서 직접 호스팅 가능)
- Tool Calling (Function Calling) 기능 지원
📍 영향 범위
제안 배경
현재 리더보드는 국내외 로컬 모델의 성능 비교 지표가 부족한 상황입니다.
이를 보완하기 위해 로컬 LLM 벤치마크를 확대하여, 한국어 기반의 오픈 생태계를 강화하고자 합니다.
요청 사항
🤗 Ko-AgentBench 리더보드에 평가 대상이 될 로컬 모델 후보를 제안해 주세요!
💬 제안 시 포함 항목
- 모델명
- URL
- 파라미터 규모
- 특이사항 (한국어 성능, 라이선스 등)
개요
Ko-AgentBench 리더보드의 평가 대상에 새로운 로컬 LLM 모델을 추가하고자 합니다.
한국어 이해력과 도구 호출 기능을 갖춘 모델들을 중심으로 벤치마크 확장을 제안합니다.
📊 현재 리더보드 대상 로컬 모델
✅ 추가 기준
📍 영향 범위
제안 배경
현재 리더보드는 국내외 로컬 모델의 성능 비교 지표가 부족한 상황입니다.
이를 보완하기 위해 로컬 LLM 벤치마크를 확대하여, 한국어 기반의 오픈 생태계를 강화하고자 합니다.
요청 사항
🤗 Ko-AgentBench 리더보드에 평가 대상이 될 로컬 모델 후보를 제안해 주세요!
💬 제안 시 포함 항목