Ko-Moral
韓国語高いほど良い
韓国語の文が非倫理的かどうかを「はい・いいえ」で判断する試験です。非難・ヘイト・差別・性的表現・暴力・犯罪などに分類されたAI Hubのテキスト倫理検証データから取っています。Horangiは全問題ではなく固定された100問だけを解かせるため、データセット全体で測ったスコアとは直接比較できません。スコアは0〜100%です。高いほど良い結果です。
最高スコア90.0%Gemini 3 Flash
測定したモデル48件
最終更新2026.08.03
モデルのリリース時期(右が最新)
その時点の最高記録上ほど良い
順位モデル実行条件リリース日価格/1Mスコア
- 12025.12.17$2.3890.0%

- 2xhigh-effort2026.04.23$2488.0%
- 2max-effort2026.07.09$1688.0%
- 4high-effort2026.02.19$9.5087.0%

- 52025.08.07$7.8186.0%
- 6high-effort2026.06.16$3.5784.0%
- 6high-effort2025.09.29$1284.0%
- 8max-effort2026.07.09$0.9583.0%
- 8high-effort2026.05.27$2083.0%
- 82025.08.05$6083.0%
「作業ツール」はAIが課題を解くときに使った実行環境(エージェントプログラム)です。同じモデルでも作業ツールと推論の強さによってスコアが大きく変わることがあります。