| Gemini 3.7 Flash gemini-3-7-flash-medium | Gemini 3.7 Flash | 90.7% | August 2026Artificial Analysis Harvey LAB-AA public leaderboard | Score input provider-reported | Google DeepMind permanent refresh source ↗Observed 2026-08-13 · checked 2026-08-13 |
|---|
| Claude Sonnet 5 claude-sonnet-5-max | Claude Sonnet 5 | 90.1% | August 2026Artificial Analysis Harvey LAB-AA public leaderboard | Public reference · not scored provider-reported | Google DeepMind permanent refresh source ↗Observed 2026-08-13 · checked 2026-08-13 |
|---|
| GPT-5.6 Terra gpt-5-6-terra-max | GPT-5.6 Terra | 85.2% | August 2026Artificial Analysis Harvey LAB-AA public leaderboard | Public reference · not scored provider-reported | Google DeepMind permanent refresh source ↗Observed 2026-08-13 · checked 2026-08-13 |
|---|
| Gemini 3.6 Flash gemini-3-6-flash-high | Gemini 3.6 Flash | 85.1% | August 2026Artificial Analysis Harvey LAB-AA public leaderboard | Public reference · not scored provider-reported | Google DeepMind permanent refresh source ↗Observed 2026-08-13 · checked 2026-08-13 |
|---|
| Grok 4.6 High grok-4-6-high | Grok 4.6 | 15.8% | CurrentxAI Grok 4.6 official release comparison table | Score input provider-reported | Grok 4.6 ↗Observed 2026-08-12 · checked 2026-08-12 |
|---|
| Grok 4.5 High grok-4-5-aa-2-high | Grok 4.5 | 12.9% | CurrentxAI Grok 4.6 official release comparison table | Relative comparison · not standard direct provider-reported | Grok 4.6 ↗Observed 2026-08-12 · checked 2026-08-12 |
|---|
| Fable 5 Max claude-fable-5-max | Claude Fable 5 | 11.3% | CurrentxAI Grok 4.6 official release comparison table | Relative comparison · not standard direct provider-reported | Grok 4.6 ↗Observed 2026-08-12 · checked 2026-08-12 |
|---|
| GPT-5.6 Sol Max gpt-5-6-sol-max | GPT-5.6 Sol | 2.5% | CurrentxAI Grok 4.6 official release comparison table | Relative comparison · not standard direct provider-reported | Grok 4.6 ↗Observed 2026-08-12 · checked 2026-08-12 |
|---|
| Legal Agent Benchmark held-out split as published in the Anthropic Claude Opus 5 launch table. source label without registered configuration ID | Claude Opus 5 | 11.7% | CurrentAnthropic provider evaluation | Score input provider-reported | Introducing Claude Opus 5 ↗Observed 2026-07-24 · checked 2026-07-24 |
|---|
| Kimi K3; Artificial Analysis Harvey LAB-AA evaluation. source label without registered configuration ID | Kimi K3 | 26.7% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Kimi K3 Intelligence, Performance & Price Analysis ↗Observed 2026-07-20 · checked 2026-07-21 |
|---|
| Muse Spark 1.1 (xhigh); Artificial Analysis independent evaluation configuration as published. muse-spark-1-1-xhigh | Muse Spark 1.1 | 8.3% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Muse Spark 1.1 (xhigh) analysis ↗Observed 2026-07-16 · checked 2026-07-16 |
|---|
| Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) claude-fable-5-max | Claude Fable 5 | 14.2% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Grok 4.5 (high) source label without registered configuration ID | Grok 4.5 | 13.3% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Muse Spark 1.1 (xhigh) muse-spark-1-1-xhigh | Muse Spark 1.1 | 8.3% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Claude Opus 4.8 (Adaptive Reasoning, Max Effort) claude-opus-4-8-max | Claude Opus 4.8 | 7.5% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| GLM-5.2 (max) glm-5-2-max | GLM-5.2 | 7.5% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| MiniMax-M3 source label without registered configuration ID | MiniMax M3 | 6.7% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| GPT-5.6 Luna (max) gpt-5-6-luna-max | GPT-5.6 Luna | 5% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Claude Sonnet 5 (Adaptive Reasoning, Max Effort) claude-sonnet-5-max | Claude Sonnet 5 | 5% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) claude-sonnet-4-6-max | Claude Sonnet 4.6 | 4.2% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| GPT-5.5 (xhigh) gpt-5-5-xhigh | GPT-5.5 | 4.2% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| DeepSeek V4 Pro (Reasoning, Max Effort) deepseek-v4-pro-max | DeepSeek V4 Pro | 3.3% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Nemotron 3 Ultra 550B A55B (Reasoning) source label without registered configuration ID | Nemotron 3 Ultra | 3.3% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| GPT-5.6 Terra (max) gpt-5-6-terra-max | GPT-5.6 Terra | 2.5% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| DeepSeek V4 Flash (Reasoning, Max Effort) deepseek-v4-flash-max | DeepSeek V4 Flash | 1.7% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Qwen3.7 Plus source label without registered configuration ID | Qwen3.7-Plus | 1.7% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Gemini 3.5 Flash (high) gemini-3-5-flash-high | Gemini 3.5 Flash | 1.7% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Mistral Medium 3.5 source label without registered configuration ID | Mistral Medium 3.5 | 0.8% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Kimi K2.7 Code source label without registered configuration ID | Kimi K2.7 Code | 0.8% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Gemini 3.1 Flash-Lite source label without registered configuration ID | Gemini 3.1 Flash-Lite | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Grok 4.3 (high) source label without registered configuration ID | Grok 4.3 | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Qwen3.7 Max source label without registered configuration ID | Qwen3.7-Max | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| GPT-5.4 nano (xhigh) gpt-5-4-nano-xhigh | GPT-5.4 nano | 0% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Claude 4.5 Haiku (Reasoning) source label without registered configuration ID | Claude Haiku 4.5 | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Gemini 3.1 Pro Preview source label without registered configuration ID | Gemini 3.1 Pro Preview | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Gemma 4 31B (Reasoning) source label without registered configuration ID | Gemma 4 31B | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| GPT-5.4 mini (xhigh) gpt-5-4-mini-xhigh | GPT-5.4 mini | 0% | CurrentArtificial Analysis independent evaluation | Public reference · not scored source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Claude 4.1 Opus (Reasoning) source label without registered configuration ID | Claude Opus 4.1 | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Kimi K2.6 source label without registered configuration ID | Kimi K2.6 | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| Qwen3.5 397B A17B (Reasoning) source label without registered configuration ID | Qwen3.5 397B A17B | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|
| MiMo-V2.5-Pro source label without registered configuration ID | MiMo-V2.5-Pro | 0% | CurrentArtificial Analysis independent evaluation | Score input source-checked | Harvey LAB-AA Leaderboard ↗Observed 2026-07-15 · checked 2026-07-15 |
|---|