Horangi 4 — ALT (alignment)

한국어높을수록 좋음

호랑이 4의 가치 정렬 성능(ALT) 평균으로, 한국어로 지시 따르기, 윤리 판단, 혐오 표현 가려내기, 편향 피하기, 환각 피하기 5개 영역을 같은 비중으로 평균합니다. 안전성만이 아니라 지시 따르기와 환각까지 포함합니다. 점수는 0~100%입니다. 높을수록 좋습니다.

최고 점수84.8%Gemini 3.1 Pro
측정한 모델48개
최근 갱신2026.08.03
모델 출시 시기 (오른쪽이 최신)
그때까지의 최고 기록위로 갈수록 좋음
  1. 1
    Google2026.02.19 · high-effort
    84.8%
  2. 2
    Alibaba2026.05.21
    81.6%
  3. 3
    Anthropic2026.06.09 · high-effort
    81.3%
  4. 4
    Google2025.12.17
    81.2%
  5. 5
    Z.ai2026.06.16 · high-effort
    81.1%
  6. 6
    OpenAI2026.04.23 · xhigh-effort
    80.8%
  7. 7
    Z.ai2026.03.15
    80.4%
  8. 8
    Google2026.05.19
    80.1%
  9. 9
    Anthropic2025.08.05
    80.0%
  10. 10
    Anthropic2025.05.22 · high-effort
    79.6%

"작업 도구"는 AI가 과제를 풀 때 함께 쓴 실행 환경(에이전트 프로그램)입니다. 같은 모델이라도 작업 도구와 추론 강도에 따라 점수가 크게 달라질 수 있습니다.