Head to head
Pairs are derived from the catalogue: a matchup appears here once both sides have run the same prompt. No pair is ranked against another.
Coding agents
Same prompt, same model where possible — the variable is the program driving it.
Models
Same prompt, different models.
- Fable 5vsKimi K36 prompts
- Opus 5vsKimi K34 prompts
- Opus 5vsFable 53 prompts
- Opus 5vsQwen 3.8 Max3 prompts
- Opus 5vsGPT-5.62 prompts
- GPT-5.6vsKimi K32 prompts
- Claude Opus 4.7vsKimi K2.61 prompt
- Claude Opus 4.8vsKimi K31 prompt
- Opus 5vsGPT-5.6 Sol1 prompt
- Opus 5vsGrok 4.51 prompt
- Opus 5vs1-bit Kimi K31 prompt
- DeepSeek V4 Flash-0731vsGLM 5.2 (high)1 prompt
- DeepSeek V4 Flash-0731vsGrok 4.5 (high)1 prompt
- DeepSeek V4 Flash-0731vsKimi K3 (high)1 prompt
- DeepSeek V4 Flash-0731vsLuna 5.6 (max reasoning)1 prompt
- Fable 5vsGPT 5.61 prompt
- Fable 5vsGPT-5.6 Sol1 prompt
- Fable 5vsGrok 4.51 prompt
- Fable 5vsQwen 3.8 Max1 prompt
- GLM 5.2 (high)vsGrok 4.5 (high)1 prompt
- GLM 5.2 (high)vsKimi K3 (high)1 prompt
- GLM 5.2 (high)vsLuna 5.6 (max reasoning)1 prompt
- GPT-5.6 SolvsGrok 4.51 prompt
- GPT-5.6vs1-bit Kimi K31 prompt
- Grok 4.5 (high)vsKimi K3 (high)1 prompt
- Grok 4.5 (high)vsLuna 5.6 (max reasoning)1 prompt
- Kimi K3vs1-bit Kimi K31 prompt
- Kimi K3 (high)vsLuna 5.6 (max reasoning)1 prompt