Compare AIFind AIAI NewsAI How-To
About Us
Back to list

Overall AI model performance rankings

Which AI has the best overall performance? An overall performance ranking of 119 AI models across 4 evaluations, including AA Intelligence Index · Arena Text · LiveBench Overall.

How strong is it across many tests combined?

AA Intelligence Index

Learn more about this evaluation

  1. 🥇AnthropicClaude Opus 5.5Reasoning effort: MaxQ157.6Q21504Q382.1
  2. 🥈AnthropicClaude Sonnet 5.5Reasoning effort: MaxQ156.0Q21471Q377.8
  3. 🥉AnthropicClaude Fable 5.1Reasoning effort: MaxQ153.4Q21501Q383.4
  4. #4OpenAIGPT-6 AstraReasoning effort: MaxQ152.7Q21477Q382.2
  5. #5GoogleGemini 4 ArgonReasoning effort: HighQ152.6Q21525Q3—
  6. #6OpenAIGPT-6.1 SolReasoning effort: MaxQ151.8Q21483Q381.1
  7. #7AnthropicClaude Opus 5Reasoning effort: MaxQ150.8Q21490Q380.1
  8. #8AnthropicClaude Fable 5Reasoning effort: MaxQ149.6Q21504Q383.0
  9. #9MetaMuse Spark 1.3Reasoning effort: MaxQ148.1Q21494Q381.6
  10. #10OpenAIGPT-6 SolReasoning effort: MaxQ147.6Q21457Q379.3
  11. #11OpenAIGPT-5.6 SolReasoning effort: MaxQ147.0Q21484Q381.0
  12. #12xAIGrok 4.7Reasoning effort: Extra HighQ146.4Q21443Q377.4
  13. #13XiaomiMiMo-V2.6-ProQ146.3Q21480Q3—
  14. #14Z.aiGLM 5.3Reasoning effort: MaxQ144.8Q21479Q376.1
  15. #15xAIGrok 4.6Reasoning effort: HighQ144.3Q21454Q378.0
  16. #16StepfunStep-5Q143.7Q21454Q3—
  17. #17Moonshot AIKimi K3Reasoning effort: MaxQ143.6Q21488Q379.2
  18. #18AnthropicClaude Haiku 5.5Reasoning effort: MaxQ143.4Q2—Q3—
  19. #19OpenAIGPT-5.6 TerraReasoning effort: MaxQ142.1Q21466Q377.9
  20. #20AnthropicClaude Opus 4.8Reasoning effort: MaxQ141.8Q21475Q376.2
  21. #20Z.aiGLM 5.3 FlashQ141.8Q21473Q371.6
  22. #22GoogleGemini 3.8 FlashReasoning effort: HighQ140.9Q21495Q375.8
  23. #23AnthropicClaude Opus 4.7Reasoning effort: MaxQ140.7Q21494Q376.5
  24. #24AlibabaQwen3.8 FlashQ139.8Q2—Q376.2
  25. #25GoogleGemini 3.7 FlashReasoning effort: MediumQ139.6Q21488Q378.8
  26. #25MetaMuse Spark 1.2Reasoning effort: Extra HighQ139.6Q21494Q378.0
  27. #27DeepSeekDeepSeek V4.1 FlashReasoning effort: MaxQ139.5Q21474Q381.1
  28. #28OpenAIGPT-5.4Reasoning effort: Extra HighQ139.0Q21475Q378.0
  29. #29xAIGrok 4.5Reasoning effort: HighQ138.8Q21466Q375.8
  30. #30OpenAIGPT-5.5Reasoning effort: Extra HighQ138.4Q21477Q380.2
  31. #30Mistral AIMistral Large 4Q138.4Q2—Q3—
  32. #32AnthropicClaude Sonnet 5Reasoning effort: MaxQ138.2Q21462Q376.0
  33. #33OpenAIGPT-6 LunaReasoning effort: MaxQ138.1Q21443Q372.0
  34. #34XiaomiMiMo-V2.6-FlashQ137.9Q21452Q3—
  35. #35OpenAIGPT-5.6 LunaReasoning effort: MaxQ137.3Q21453Q373.6
  36. #36DeepSeekDeepSeek V4 ProReasoning effort: MaxQ136.0Q21458Q371.6
  37. #37DeepSeekDeepSeek V4 FlashReasoning effort: MaxQ134.3Q21436Q365.5
  38. #38GoogleGemini 3.6 FlashReasoning effort: HighQ134.0Q21483Q373.6
  39. #39Z.aiGLM 5.2Reasoning effort: MaxQ133.7Q21476Q373.2
  40. #39MetaMuse Spark 1.1Reasoning effort: Extra HighQ133.7Q21491Q375.3
  41. #41GoogleGemini 3.5 FlashReasoning effort: MediumQ133.6Q21476Q374.6
  42. #41Motif TechnologiesMotif 3Q133.6Q2—Q3—
  43. #43AnthropicClaude Opus 4.6Reasoning effort: MaxQ131.9Q21497Q374.5
  44. #44MetaMuse SparkQ131.3Q21489Q3—
  45. #45AnthropicClaude Sonnet 4.6Reasoning effort: MaxQ130.1Q21472Q373.0
  46. #46GoogleGemini 3.1 ProQ129.7Q21487Q377.0
  47. #47AlibabaQwen3.7 MaxQ129.5Q21475Q373.1
  48. #48MiniMaxMiniMax M3Q129.2Q21440Q367.3
  49. #49AnthropicClaude Opus 4.5Reasoning effort: ThinkingQ129.1Q21470Q372.6
  50. #50XiaomiMiMo V2 ProQ128.6Q21448Q3—
  51. #51AlibabaQwen3.6 MaxQ128.4Q21460Q3—
  52. #52UpstageSolar Pro 4Q128.2Q21386Q3—
  53. #53Z.aiGLM-5Reasoning effort: ThinkingQ127.9Q21458Q3—
  54. #54Moonshot AIKimi K2.6Reasoning effort: ThinkingQ127.0Q21461Q370.5
  55. #54AlibabaQwen3.6 PlusQ127.0Q21443Q368.9
  56. #56Z.aiGLM-5-TurboQ126.6Q2—Q3—
  57. #57GoogleGemini 3 FlashReasoning effort: ThinkingQ126.3Q21473Q3—
  58. #58Z.aiGLM-5.1Reasoning effort: ThinkingQ126.1Q21465Q3—
  59. #59XiaomiMiMo V2.5 ProReasoning effort: ThinkingQ126.0Q21468Q3—
  60. #60Moonshot AIKimi K2.7 CodeQ125.8Q2—Q368.4
  61. #61xAIGrok 4.20 (Reasoning)Reasoning effort: ThinkingQ125.7Q21472Q3—
  62. #62TencentHy3Q125.3Q21409Q3—
  63. #63XiaomiMiMo V2.5Q125.2Q21434Q3—
  64. #63AlibabaQwen3.7 PlusQ125.2Q21456Q3—
  65. #65xAIGrok 4.3Reasoning effort: HighQ124.9Q21441Q362.3
  66. #66OpenAIGPT-5.4 MiniReasoning effort: Extra HighQ124.1Q21447Q366.4
  67. #66UpstageSolar Mini 4Q124.1Q2—Q3—
  68. #68Z.aiGLM 5V TurboReasoning effort: ThinkingQ123.5Q21434Q3—
  69. #68Moonshot AIKimi K2.5Reasoning effort: ThinkingQ123.5Q21450Q3—
  70. #70OpenAIGPT-5Reasoning effort: HighQ123.0Q21435Q3—
  71. #71NVIDIANemotron 3 UltraReasoning effort: ThinkingQ122.9Q21426Q367.4
  72. #72AnthropicClaude Opus 4.1Reasoning effort: ThinkingQ122.8Q21450Q3—
  73. #72MiniMaxMiniMax M2.5Q122.8Q21391Q3—
  74. #72MiniMaxMiniMax M2.7Q122.8Q21415Q3—
  75. #75GoogleGemini 3.5 Flash-LiteQ122.2Q21455Q363.9
  76. #76SK TelecomA.X K2Q121.5Q2—Q3—
  77. #76DeepSeekDeepSeek V3.2Reasoning effort: ThinkingQ121.5Q21425Q3—
  78. #78AlibabaQwen3.5 397B A17BReasoning effort: NoneQ121.4Q21442Q3—
  79. #79AnthropicClaude Sonnet 4.5Reasoning effort: ThinkingQ120.7Q21455Q3—
  80. #79OpenAIGPT-5.4 NanoReasoning effort: Extra HighQ120.7Q21401Q369.6
  81. #81AnthropicClaude Opus 4Reasoning effort: ThinkingQ120.6Q21426Q3—
  82. #81OpenAIGPT-5 MiniReasoning effort: MediumQ120.6Q21390Q3—
  83. #83xAIGrok 4.1 Fast (Reasoning)Reasoning effort: ThinkingQ120.4Q21430Q3—
  84. #83AlibabaQwen3.5 PlusQ120.4Q2—Q3—
  85. #85LG AI ResearchK-EXAONE 2.0Q119.7Q2—Q3—
  86. #86StepfunStep 3.7 FlashQ119.5Q2—Q3—
  87. #87MeituanLongCat 2.0Q119.1Q2—Q3—
  88. #88AnthropicClaude Sonnet 4Reasoning effort: ThinkingQ118.9Q21402Q3—
  89. #89AlibabaQwen3.6 35B A3BReasoning effort: ThinkingQ118.2Q2—Q3—
  90. #90AnthropicClaude Haiku 4.5Reasoning effort: ThinkingQ116.9Q21414Q3—
  91. #91Ring AIRing-2.6-1TQ116.6Q2—Q3—
  92. #92GoogleGemini 2.5 ProQ116.1Q21446Q3—
  93. #93GoogleGemini 3.1 Flash LiteQ115.6Q21433Q3—
  94. #94GoogleGemma 4 31BReasoning effort: ThinkingQ114.7Q21453Q3—
  95. #95LG AI ResearchK-EXAONEReasoning effort: ThinkingQ114.4Q2—Q3—
  96. #96BaiduERNIE 5.0 ThinkingQ114.3Q21446Q3—
  97. #97xAIGrok 4.20Reasoning effort: NoneQ114.2Q21475Q3—
  98. #97Mistral AIMistral Medium 3.5Q114.2Q21427Q3—
  99. #99AmazonNova 2 LiteReasoning effort: HighQ113.4Q21335Q3—
  100. #100GoogleGemini 2.5 FlashReasoning effort: ThinkingQ113.1Q21409Q3—
  101. #101OpenAIGPT-5 NanoReasoning effort: HighQ113.0Q21338Q3—
  102. #102NVIDIANemotron 3 SuperReasoning effort: ThinkingQ112.8Q21361Q3—
  103. #103OpenAIGPT-4.1Q112.7Q21313Q3—
  104. #104OpenAIGPT OSS 120BReasoning effort: HighQ111.6Q21352Q3—
  105. #105MeituanLongcat Flash ChatQ111.5Q21437Q3—
  106. #106xAIGrok 4.1 FastReasoning effort: NoneQ111.3Q2—Q3—
  107. #106Mistral AIMistral Small 4Reasoning effort: ThinkingQ111.3Q2—Q3—
  108. #108Arcee AITrinity Large ThinkingQ110.8Q21367Q3—
  109. #109GoogleGemini 2.5 Flash LiteReasoning effort: ThinkingQ110.4Q21379Q3—
  110. #110NVIDIANemotron 3 Nano OmniQ110.3Q2—Q3—
  111. #111MetaLlama 4 MaverickQ110.0Q21327Q3—
  112. #112CohereNorth Mini CodeQ19.9Q2—Q3—
  113. #113NVIDIANemotron 3 Nano 30B A3BReasoning effort: ThinkingQ18.9Q21314Q3—
  114. #114MetaLlama 4 ScoutQ18.1Q21322Q3—
  115. #115UpstageSolar Pro 3Q17.8Q2—Q3—
  116. #116PerplexitySonarQ17.7Q2—Q3—
  117. #117IBMGranite 4.1 8BQ16.6Q21304Q3—
Half of models ≤ 26.0

AI recommendations and rankings by use

  • Overall AI model performance rankingsAI rankings for automationAI rankings for documents and office workAI rankings for research and fact-checkingAI rankings for coding
  • AI rankings for writing and chatAI rankings for math and scienceAI rankings for image understanding and analysisAI rankings for classification and judgmentAI rankings for image, video and audio generation
PrivacyTermsFAQContactContact
English
AIB Inc.Company info
© 2026 AIB Inc.