Compare AIFind AIAI NewsAI How-To
About Us
Back to list

Overall AI model performance rankings

Which AI has the best overall performance? An overall performance ranking of 118 AI models across 4 evaluations, including AA Intelligence Index · Arena Text · LiveBench Overall.

How strong is it across many tests combined?

AA Intelligence Index

Learn more about this evaluation

  1. 🥇AnthropicClaude Opus 5.5Reasoning effort: MaxQ157.6Q21504Q382.1
  2. 🥈AnthropicClaude Sonnet 5.5Reasoning effort: MaxQ156.0Q21471Q377.8
  3. 🥉AnthropicClaude Fable 5.1Reasoning effort: MaxQ153.4Q21501Q383.4
  4. #4OpenAIGPT-6 AstraReasoning effort: MaxQ152.7Q21477Q382.2
  5. #5GoogleGemini 4 ArgonReasoning effort: HighQ152.6Q21525Q3—
  6. #6OpenAIGPT-6.1 SolReasoning effort: MaxQ151.8Q21483Q381.1
  7. #7AnthropicClaude Opus 5Reasoning effort: MaxQ150.8Q21490Q380.1
  8. #8AnthropicClaude Fable 5Reasoning effort: MaxQ149.6Q21504Q383.0
  9. #9MetaMuse Spark 1.3Reasoning effort: MaxQ148.1Q21494Q381.6
  10. #10OpenAIGPT-6 SolReasoning effort: MaxQ147.6Q21457Q379.3
  11. #11OpenAIGPT-5.6 SolReasoning effort: MaxQ147.0Q21484Q381.0
  12. #12xAIGrok 4.7Reasoning effort: Extra HighQ146.4Q21443Q377.4
  13. #13XiaomiMiMo-V2.6-ProQ146.3Q21480Q3—
  14. #14Z.aiGLM 5.3Reasoning effort: MaxQ144.8Q21479Q376.1
  15. #15xAIGrok 4.6Reasoning effort: HighQ144.3Q21454Q378.0
  16. #16StepfunStep-5Q143.7Q21454Q3—
  17. #17Moonshot AIKimi K3Reasoning effort: MaxQ143.6Q21488Q379.2
  18. #18OpenAIGPT-5.6 TerraReasoning effort: MaxQ142.1Q21466Q377.9
  19. #19AnthropicClaude Opus 4.8Reasoning effort: MaxQ141.8Q21475Q376.2
  20. #19Z.aiGLM 5.3 FlashQ141.8Q21473Q371.6
  21. #21GoogleGemini 3.8 FlashReasoning effort: HighQ140.9Q21495Q375.8
  22. #22AnthropicClaude Opus 4.7Reasoning effort: MaxQ140.7Q21494Q376.5
  23. #23AlibabaQwen3.8 FlashQ139.8Q2—Q376.2
  24. #24GoogleGemini 3.7 FlashReasoning effort: MediumQ139.6Q21488Q378.8
  25. #24MetaMuse Spark 1.2Reasoning effort: Extra HighQ139.6Q21494Q378.0
  26. #26DeepSeekDeepSeek V4.1 FlashReasoning effort: MaxQ139.5Q21474Q381.1
  27. #27OpenAIGPT-5.4Reasoning effort: Extra HighQ139.0Q21475Q378.0
  28. #28xAIGrok 4.5Reasoning effort: HighQ138.8Q21466Q375.8
  29. #29OpenAIGPT-5.5Reasoning effort: Extra HighQ138.4Q21477Q380.2
  30. #29Mistral AIMistral Large 4Q138.4Q2—Q3—
  31. #31AnthropicClaude Sonnet 5Reasoning effort: MaxQ138.2Q21462Q376.0
  32. #32OpenAIGPT-6 LunaReasoning effort: MaxQ138.1Q21443Q372.0
  33. #33XiaomiMiMo-V2.6-FlashQ137.9Q21452Q3—
  34. #34OpenAIGPT-5.6 LunaReasoning effort: MaxQ137.3Q21453Q373.6
  35. #35DeepSeekDeepSeek V4 ProReasoning effort: MaxQ136.0Q21458Q371.6
  36. #36DeepSeekDeepSeek V4 FlashReasoning effort: MaxQ134.3Q21436Q365.5
  37. #37GoogleGemini 3.6 FlashReasoning effort: HighQ134.0Q21483Q373.6
  38. #38Z.aiGLM 5.2Reasoning effort: MaxQ133.7Q21476Q373.2
  39. #38MetaMuse Spark 1.1Reasoning effort: Extra HighQ133.7Q21491Q375.3
  40. #40GoogleGemini 3.5 FlashReasoning effort: MediumQ133.6Q21476Q374.6
  41. #40Motif TechnologiesMotif 3Q133.6Q2—Q3—
  42. #42AnthropicClaude Opus 4.6Reasoning effort: MaxQ131.9Q21497Q374.5
  43. #43MetaMuse SparkQ131.3Q21489Q3—
  44. #44AnthropicClaude Sonnet 4.6Reasoning effort: MaxQ130.1Q21472Q373.0
  45. #45GoogleGemini 3.1 ProQ129.7Q21487Q377.0
  46. #46AlibabaQwen3.7 MaxQ129.5Q21475Q373.1
  47. #47MiniMaxMiniMax M3Q129.2Q21440Q367.3
  48. #48AnthropicClaude Opus 4.5Reasoning effort: ThinkingQ129.1Q21470Q372.6
  49. #49XiaomiMiMo V2 ProQ128.6Q21448Q3—
  50. #50AlibabaQwen3.6 MaxQ128.4Q21460Q3—
  51. #51UpstageSolar Pro 4Q128.2Q21386Q3—
  52. #52Z.aiGLM-5Reasoning effort: ThinkingQ127.9Q21458Q3—
  53. #53Moonshot AIKimi K2.6Reasoning effort: ThinkingQ127.0Q21461Q370.5
  54. #53AlibabaQwen3.6 PlusQ127.0Q21443Q368.9
  55. #55Z.aiGLM-5-TurboQ126.6Q2—Q3—
  56. #56GoogleGemini 3 FlashReasoning effort: ThinkingQ126.3Q21473Q3—
  57. #57Z.aiGLM-5.1Reasoning effort: ThinkingQ126.1Q21465Q3—
  58. #58XiaomiMiMo V2.5 ProReasoning effort: ThinkingQ126.0Q21468Q3—
  59. #59Moonshot AIKimi K2.7 CodeQ125.8Q2—Q368.4
  60. #60xAIGrok 4.20 (Reasoning)Reasoning effort: ThinkingQ125.7Q21472Q3—
  61. #61TencentHy3Q125.3Q21409Q3—
  62. #62XiaomiMiMo V2.5Q125.2Q21434Q3—
  63. #62AlibabaQwen3.7 PlusQ125.2Q21456Q3—
  64. #64xAIGrok 4.3Reasoning effort: HighQ124.9Q21441Q362.3
  65. #65OpenAIGPT-5.4 MiniReasoning effort: Extra HighQ124.1Q21447Q366.4
  66. #65UpstageSolar Mini 4Q124.1Q2—Q3—
  67. #67Z.aiGLM 5V TurboReasoning effort: ThinkingQ123.5Q21434Q3—
  68. #67Moonshot AIKimi K2.5Reasoning effort: ThinkingQ123.5Q21450Q3—
  69. #69OpenAIGPT-5Reasoning effort: HighQ123.0Q21435Q3—
  70. #70NVIDIANemotron 3 UltraReasoning effort: ThinkingQ122.9Q21426Q367.4
  71. #71AnthropicClaude Opus 4.1Reasoning effort: ThinkingQ122.8Q21450Q3—
  72. #71MiniMaxMiniMax M2.5Q122.8Q21391Q3—
  73. #71MiniMaxMiniMax M2.7Q122.8Q21415Q3—
  74. #74GoogleGemini 3.5 Flash-LiteQ122.2Q21455Q363.9
  75. #75SK TelecomA.X K2Q121.5Q2—Q3—
  76. #75DeepSeekDeepSeek V3.2Reasoning effort: ThinkingQ121.5Q21425Q3—
  77. #77AlibabaQwen3.5 397B A17BReasoning effort: NoneQ121.4Q21442Q3—
  78. #78AnthropicClaude Sonnet 4.5Reasoning effort: ThinkingQ120.7Q21455Q3—
  79. #78OpenAIGPT-5.4 NanoReasoning effort: Extra HighQ120.7Q21401Q369.6
  80. #80AnthropicClaude Opus 4Reasoning effort: ThinkingQ120.6Q21426Q3—
  81. #80OpenAIGPT-5 MiniReasoning effort: MediumQ120.6Q21390Q3—
  82. #82xAIGrok 4.1 Fast (Reasoning)Reasoning effort: ThinkingQ120.4Q21430Q3—
  83. #82AlibabaQwen3.5 PlusQ120.4Q2—Q3—
  84. #84LG AI ResearchK-EXAONE 2.0Q119.7Q2—Q3—
  85. #85StepfunStep 3.7 FlashQ119.5Q2—Q3—
  86. #86MeituanLongCat 2.0Q119.1Q2—Q3—
  87. #87AnthropicClaude Sonnet 4Reasoning effort: ThinkingQ118.9Q21402Q3—
  88. #88AlibabaQwen3.6 35B A3BReasoning effort: ThinkingQ118.2Q2—Q3—
  89. #89AnthropicClaude Haiku 4.5Reasoning effort: ThinkingQ116.9Q21414Q3—
  90. #90Ring AIRing-2.6-1TQ116.6Q2—Q3—
  91. #91GoogleGemini 2.5 ProQ116.1Q21446Q3—
  92. #92GoogleGemini 3.1 Flash LiteQ115.6Q21433Q3—
  93. #93GoogleGemma 4 31BReasoning effort: ThinkingQ114.7Q21453Q3—
  94. #94LG AI ResearchK-EXAONEReasoning effort: ThinkingQ114.4Q2—Q3—
  95. #95BaiduERNIE 5.0 ThinkingQ114.3Q21446Q3—
  96. #96xAIGrok 4.20Reasoning effort: NoneQ114.2Q21475Q3—
  97. #96Mistral AIMistral Medium 3.5Q114.2Q21427Q3—
  98. #98AmazonNova 2 LiteReasoning effort: HighQ113.4Q21335Q3—
  99. #99GoogleGemini 2.5 FlashReasoning effort: ThinkingQ113.1Q21409Q3—
  100. #100OpenAIGPT-5 NanoReasoning effort: HighQ113.0Q21338Q3—
  101. #101NVIDIANemotron 3 SuperReasoning effort: ThinkingQ112.8Q21361Q3—
  102. #102OpenAIGPT-4.1Q112.7Q21313Q3—
  103. #103OpenAIGPT OSS 120BReasoning effort: HighQ111.6Q21352Q3—
  104. #104MeituanLongcat Flash ChatQ111.5Q21437Q3—
  105. #105xAIGrok 4.1 FastReasoning effort: NoneQ111.3Q2—Q3—
  106. #105Mistral AIMistral Small 4Reasoning effort: ThinkingQ111.3Q2—Q3—
  107. #107Arcee AITrinity Large ThinkingQ110.8Q21367Q3—
  108. #108GoogleGemini 2.5 Flash LiteReasoning effort: ThinkingQ110.4Q21379Q3—
  109. #109NVIDIANemotron 3 Nano OmniQ110.3Q2—Q3—
  110. #110MetaLlama 4 MaverickQ110.0Q21327Q3—
  111. #111CohereNorth Mini CodeQ19.9Q2—Q3—
  112. #112NVIDIANemotron 3 Nano 30B A3BReasoning effort: ThinkingQ18.9Q21314Q3—
  113. #113MetaLlama 4 ScoutQ18.1Q21322Q3—
  114. #114UpstageSolar Pro 3Q17.8Q2—Q3—
  115. #115PerplexitySonarQ17.7Q2—Q3—
  116. #116IBMGranite 4.1 8BQ16.6Q21304Q3—
Half of models ≤ 25.9

AI recommendations and rankings by use

  • Overall AI model performance rankingsAI rankings for automationAI rankings for documents and office workAI rankings for research and fact-checkingAI rankings for coding
  • AI rankings for writing and chatAI rankings for math and scienceAI rankings for image understanding and analysisAI rankings for classification and judgmentAI rankings for image, video and audio generation
PrivacyTermsFAQContactContact
English
AIB Inc.Company info
© 2026 AIB Inc.