Horangi 4 — GLP (general language)

韓国語高いほど良い

Horangi 4の汎用言語性能(GLP)の平均で、韓国語の文法・意味の理解、表現、知識、数学・論理推論にコーディングと関数呼び出しまで含む11領域を加重平均します。コーディングと関数呼び出しは英語やコードの課題のため、純粋な韓国語能力だけを測る値ではありません。スコアは0〜100%です。高いほど良い結果です。

最高スコア83.9%Claude Fable 5
測定したモデル49件
最終更新2026.08.03
モデルのリリース時期(右が最新)
その時点の最高記録上ほど良い
  1. 1
    Anthropic2026.06.09 · high-effort
    83.9%
  2. 2
    Google2026.02.19 · high-effort
    83.4%
  3. 3
    OpenAI2026.04.23 · xhigh-effort
    82.8%
  4. 4
    OpenAI2026.07.09 · max-effort
    82.7%
  5. 5
    Google2026.05.19
    82.3%
  6. 6
    OpenAI2026.03.05 · xhigh-effort
    81.9%
  7. 7
    OpenAI2026.07.09 · max-effort
    81.6%
  8. 8
    xAI2026.07.08
    80.2%
  9. 9
    Anthropic2026.06.30 · high-effort
    79.3%
  10. 10
    Alibaba2026.05.21
    78.8%

「作業ツール」はAIが課題を解くときに使った実行環境(エージェントプログラム)です。同じモデルでも作業ツールと推論の強さによってスコアが大きく変わることがあります。