| GPT-5.6 Sol as published by Z.AI gpt-5-6-sol-max | GPT-5.6 Sol | 34.6% | 3.0Z.AI GLM-5.3 official comparison table | Excluded provider-reported | GLM-5.3: Frontier Coding with Emergent Cyber Capabilities ↗Observed 2026-08-14 · checked 2026-08-15 |
|---|
| Claude Fable 5 w/ fallback as published by Z.AI claude-fable-5-max | Claude Fable 5 | 33.7% | 3.0Z.AI GLM-5.3 official comparison table | Excluded provider-reported | GLM-5.3: Frontier Coding with Emergent Cyber Capabilities ↗Observed 2026-08-14 · checked 2026-08-15 |
|---|
| GLM-5.3 (max) glm-5-3-max | GLM-5.3 | 28.3% | 3.0Z.AI GLM-5.3 official comparison table | Reference only provider-reported | GLM-5.3: Frontier Coding with Emergent Cyber Capabilities ↗Observed 2026-08-14 · checked 2026-08-15 |
|---|
| Claude Opus 4.8 as published by Z.AI claude-opus-4-8-max | Claude Opus 4.8 | 21.1% | 3.0Z.AI GLM-5.3 official comparison table | Excluded provider-reported | GLM-5.3: Frontier Coding with Emergent Cyber Capabilities ↗Observed 2026-08-14 · checked 2026-08-15 |
|---|
| Kimi K3 as published by Z.AI kimi-k3-max | Kimi K3 | 17.4% | 3.0Z.AI GLM-5.3 official comparison table | Excluded provider-reported | GLM-5.3: Frontier Coding with Emergent Cyber Capabilities ↗Observed 2026-08-14 · checked 2026-08-15 |
|---|
| GLM-5.2 as published by Z.AI glm-5-2-max | GLM-5.2 | 4.6% | 3.0Z.AI GLM-5.3 official comparison table | Excluded provider-reported | GLM-5.3: Frontier Coding with Emergent Cyber Capabilities ↗Observed 2026-08-14 · checked 2026-08-15 |
|---|
| GPT-5.6 Terra gpt-5-6-terra-max | GPT-5.6 Terra | 20.8% | 3.0Terminal-Bench 3.0; Gemini self-run used mini SWE agent and LiteLLM 1.96 | Reference only provider-reported | Google DeepMind permanent refresh source ↗Observed 2026-08-13 · checked 2026-08-13 |
|---|
| Gemini 3.7 Flash gemini-3-7-flash-high | Gemini 3.7 Flash | 14.9% | 3.0Terminal-Bench 3.0; Gemini self-run used mini SWE agent and LiteLLM 1.96 | Reference only provider-reported | Google DeepMind permanent refresh source ↗Observed 2026-08-13 · checked 2026-08-13 |
|---|
| Claude Sonnet 5 claude-sonnet-5-max | Claude Sonnet 5 | 14.6% | 3.0Terminal-Bench 3.0; Gemini self-run used mini SWE agent and LiteLLM 1.96 | Reference only provider-reported | Google DeepMind permanent refresh source ↗Observed 2026-08-13 · checked 2026-08-13 |
|---|
| Gemini 3.6 Flash gemini-3-6-flash-high | Gemini 3.6 Flash | 5.4% | 3.0Terminal-Bench 3.0; Gemini self-run used mini SWE agent and LiteLLM 1.96 | Reference only provider-reported | Google DeepMind permanent refresh source ↗Observed 2026-08-13 · checked 2026-08-13 |
|---|
| GPT-5.6 Sol Max gpt-5-6-sol-max | GPT-5.6 Sol | 34.6% | 3.0xAI Grok 4.6 official release comparison table | Reference only provider-reported | Grok 4.6 ↗Observed 2026-08-12 · checked 2026-08-12 |
|---|
| Fable 5 Max claude-fable-5-max | Claude Fable 5 | 34.1% | 3.0xAI Grok 4.6 official release comparison table | Reference only provider-reported | Grok 4.6 ↗Observed 2026-08-12 · checked 2026-08-12 |
|---|
| Grok 4.6 High grok-4-6-high | Grok 4.6 | 26% | 3.0xAI Grok 4.6 official release comparison table | Reference only provider-reported | Grok 4.6 ↗Observed 2026-08-12 · checked 2026-08-12 |
|---|
| Grok 4.5 High grok-4-5-aa-2-high | Grok 4.5 | 15.7% | 3.0xAI Grok 4.6 official release comparison table | Reference only provider-reported | Grok 4.6 ↗Observed 2026-08-12 · checked 2026-08-12 |
|---|