Horangi 4 — GLP (general language)
한국어높을수록 좋음
호랑이 4의 범용 언어 성능(GLP) 평균으로, 한국어 문법·의미 이해, 표현, 지식, 수학·논리 추론에 코딩·함수 호출까지 11개 영역을 가중 평균합니다. 코딩·함수 호출은 영어·코드 과제라 순수한 한국어 능력만 재는 값은 아닙니다. 점수는 0~100%입니다. 높을수록 좋습니다.
최고 점수83.9%Claude Fable 5
측정한 모델49개
최근 갱신2026.08.03
모델 출시 시기 (오른쪽이 최신)
그때까지의 최고 기록위로 갈수록 좋음
순위모델실행 조건출시일가격/1M점수
- 1high-effort2026.06.09$4083.9%
- 2high-effort2026.02.19$9.5083.4%

- 3xhigh-effort2026.04.23$2482.8%
- 4max-effort2026.07.09$1682.7%
- 52026.05.19$7.1382.3%

- 6xhigh-effort2026.03.05$1281.9%
- 7max-effort2026.07.09$9.5081.6%
- 82026.07.08$580.2%
- 9high-effort2026.06.30$879.3%
- 102026.05.21$3.6978.8%
"작업 도구"는 AI가 과제를 풀 때 함께 쓴 실행 환경(에이전트 프로그램)입니다. 같은 모델이라도 작업 도구와 추론 강도에 따라 점수가 크게 달라질 수 있습니다.