| OpenAI: GPT-4o vs OpenAI: GPT-5 Nano |
openai/gpt-4o |
5 |
openai/gpt-5-nano |
4 |
| OpenAI: GPT-4o vs OpenAI: GPT-5.4 Mini |
openai/gpt-4o |
5 |
openai/gpt-5.4-mini |
4 |
| OpenAI: GPT-4o vs Qwen: Qwen3 VL 8B Instruct |
openai/gpt-4o |
5 |
qwen/qwen3-vl-8b-instruct |
4 |
| MiniMax: MiniMax M2 vs OpenAI: GPT-4o |
minimax/minimax-m2 |
4 |
openai/gpt-4o |
5 |
| MiniMax M2.5-highspeed vs OpenAI: GPT-4o |
minimax/minimax-m2.5-highspeed |
4 |
openai/gpt-4o |
5 |
| DeepSeek V3 0324 vs OpenAI: GPT-4o |
deepseek/deepseek-v3-0324 |
4 |
openai/gpt-4o |
5 |
| Google: Gemma 3 12B vs OpenAI: GPT-4o |
google/gemma-3-12b-it |
4 |
openai/gpt-4o |
5 |
| Meta: Llama 3.1 70B Instruct vs OpenAI: GPT-4o |
meta-llama/llama-3.1-70b-instruct |
4 |
openai/gpt-4o |
5 |
| OpenAI: GPT-5.5 vs OpenAI: GPT-5.6 Sol |
openai/gpt-5.5 |
4 |
openai/gpt-5.6-sol |
4 |
| Google: Gemini 3.5 Flash Lite vs OpenAI: GPT-5.5 |
google/gemini-3.5-flash-lite |
4 |
openai/gpt-5.5 |
4 |
| Google: Gemini 3.6 Flash vs OpenAI: GPT-5.5 |
google/gemini-3.6-flash |
4 |
openai/gpt-5.5 |
4 |
| Meta: Llama 4 Maverick vs OpenAI: GPT-5.5 |
meta-llama/llama-4-maverick |
4 |
openai/gpt-5.5 |
4 |
| OpenAI: GPT-4.1 vs OpenAI: GPT-5.5 |
openai/gpt-4.1 |
4 |
openai/gpt-5.5 |
4 |
| NVIDIA: Nemotron 3 Super vs OpenAI: GPT-5.5 |
nvidia/nemotron-3-super-120b-a12b |
4 |
openai/gpt-5.5 |
4 |
| OpenAI: GPT-5.5 vs Qwen3.7-Max |
openai/gpt-5.5 |
4 |
qwen/qwen3.7-max |
4 |
| OpenAI: GPT-5 Nano vs OpenAI: GPT-5.5 |
openai/gpt-5-nano |
4 |
openai/gpt-5.5 |
4 |
| OpenAI: GPT-5.4 Mini vs OpenAI: GPT-5.5 |
openai/gpt-5.4-mini |
4 |
openai/gpt-5.5 |
4 |
| OpenAI: GPT-5.5 vs Qwen: Qwen3 VL 8B Instruct |
openai/gpt-5.5 |
4 |
qwen/qwen3-vl-8b-instruct |
4 |
| MiniMax: MiniMax M2 vs OpenAI: GPT-5.5 |
minimax/minimax-m2 |
4 |
openai/gpt-5.5 |
4 |
| MiniMax M2.5-highspeed vs OpenAI: GPT-5.5 |
minimax/minimax-m2.5-highspeed |
4 |
openai/gpt-5.5 |
4 |
| DeepSeek V3 0324 vs OpenAI: GPT-5.5 |
deepseek/deepseek-v3-0324 |
4 |
openai/gpt-5.5 |
4 |
| Google: Gemma 3 12B vs OpenAI: GPT-5.5 |
google/gemma-3-12b-it |
4 |
openai/gpt-5.5 |
4 |
| Meta: Llama 3.1 70B Instruct vs OpenAI: GPT-5.5 |
meta-llama/llama-3.1-70b-instruct |
4 |
openai/gpt-5.5 |
4 |
| Google: Gemini 3.5 Flash Lite vs OpenAI: GPT-5.6 Sol |
google/gemini-3.5-flash-lite |
4 |
openai/gpt-5.6-sol |
4 |
| Google: Gemini 3.6 Flash vs OpenAI: GPT-5.6 Sol |
google/gemini-3.6-flash |
4 |
openai/gpt-5.6-sol |
4 |
| Meta: Llama 4 Maverick vs OpenAI: GPT-5.6 Sol |
meta-llama/llama-4-maverick |
4 |
openai/gpt-5.6-sol |
4 |
| OpenAI: GPT-4.1 vs OpenAI: GPT-5.6 Sol |
openai/gpt-4.1 |
4 |
openai/gpt-5.6-sol |
4 |
| NVIDIA: Nemotron 3 Super vs OpenAI: GPT-5.6 Sol |
nvidia/nemotron-3-super-120b-a12b |
4 |
openai/gpt-5.6-sol |
4 |
| OpenAI: GPT-5.6 Sol vs Qwen3.7-Max |
openai/gpt-5.6-sol |
4 |
qwen/qwen3.7-max |
4 |
| OpenAI: GPT-5 Nano vs OpenAI: GPT-5.6 Sol |
openai/gpt-5-nano |
4 |
openai/gpt-5.6-sol |
4 |
| OpenAI: GPT-5.4 Mini vs OpenAI: GPT-5.6 Sol |
openai/gpt-5.4-mini |
4 |
openai/gpt-5.6-sol |
4 |
| OpenAI: GPT-5.6 Sol vs Qwen: Qwen3 VL 8B Instruct |
openai/gpt-5.6-sol |
4 |
qwen/qwen3-vl-8b-instruct |
4 |
| MiniMax: MiniMax M2 vs OpenAI: GPT-5.6 Sol |
minimax/minimax-m2 |
4 |
openai/gpt-5.6-sol |
4 |
| MiniMax M2.5-highspeed vs OpenAI: GPT-5.6 Sol |
minimax/minimax-m2.5-highspeed |
4 |
openai/gpt-5.6-sol |
4 |
| DeepSeek V3 0324 vs OpenAI: GPT-5.6 Sol |
deepseek/deepseek-v3-0324 |
4 |
openai/gpt-5.6-sol |
4 |
| Google: Gemma 3 12B vs OpenAI: GPT-5.6 Sol |
google/gemma-3-12b-it |
4 |
openai/gpt-5.6-sol |
4 |
| Meta: Llama 3.1 70B Instruct vs OpenAI: GPT-5.6 Sol |
meta-llama/llama-3.1-70b-instruct |
4 |
openai/gpt-5.6-sol |
4 |
| Google: Gemini 3.5 Flash Lite vs Google: Gemini 3.6 Flash |
google/gemini-3.5-flash-lite |
4 |
google/gemini-3.6-flash |
4 |
| Google: Gemini 3.5 Flash Lite vs Meta: Llama 4 Maverick |
google/gemini-3.5-flash-lite |
4 |
meta-llama/llama-4-maverick |
4 |
| Google: Gemini 3.5 Flash Lite vs OpenAI: GPT-4.1 |
google/gemini-3.5-flash-lite |
4 |
openai/gpt-4.1 |
4 |
| Google: Gemini 3.5 Flash Lite vs NVIDIA: Nemotron 3 Super |
google/gemini-3.5-flash-lite |
4 |
nvidia/nemotron-3-super-120b-a12b |
4 |
| Google: Gemini 3.5 Flash Lite vs Qwen3.7-Max |
google/gemini-3.5-flash-lite |
4 |
qwen/qwen3.7-max |
4 |
| Google: Gemini 3.5 Flash Lite vs OpenAI: GPT-5 Nano |
google/gemini-3.5-flash-lite |
4 |
openai/gpt-5-nano |
4 |
| Google: Gemini 3.5 Flash Lite vs OpenAI: GPT-5.4 Mini |
google/gemini-3.5-flash-lite |
4 |
openai/gpt-5.4-mini |
4 |
| Google: Gemini 3.5 Flash Lite vs Qwen: Qwen3 VL 8B Instruct |
google/gemini-3.5-flash-lite |
4 |
qwen/qwen3-vl-8b-instruct |
4 |
| Google: Gemini 3.5 Flash Lite vs MiniMax: MiniMax M2 |
google/gemini-3.5-flash-lite |
4 |
minimax/minimax-m2 |
4 |
| Google: Gemini 3.5 Flash Lite vs MiniMax M2.5-highspeed |
google/gemini-3.5-flash-lite |
4 |
minimax/minimax-m2.5-highspeed |
4 |
| DeepSeek V3 0324 vs Google: Gemini 3.5 Flash Lite |
deepseek/deepseek-v3-0324 |
4 |
google/gemini-3.5-flash-lite |
4 |
| Google: Gemini 3.5 Flash Lite vs Google: Gemma 3 12B |
google/gemini-3.5-flash-lite |
4 |
google/gemma-3-12b-it |
4 |
| Google: Gemini 3.5 Flash Lite vs Meta: Llama 3.1 70B Instruct |
google/gemini-3.5-flash-lite |
4 |
meta-llama/llama-3.1-70b-instruct |
4 |
| Google: Gemini 3.6 Flash vs Meta: Llama 4 Maverick |
google/gemini-3.6-flash |
4 |
meta-llama/llama-4-maverick |
4 |
| Google: Gemini 3.6 Flash vs OpenAI: GPT-4.1 |
google/gemini-3.6-flash |
4 |
openai/gpt-4.1 |
4 |
| Google: Gemini 3.6 Flash vs NVIDIA: Nemotron 3 Super |
google/gemini-3.6-flash |
4 |
nvidia/nemotron-3-super-120b-a12b |
4 |
| Google: Gemini 3.6 Flash vs Qwen3.7-Max |
google/gemini-3.6-flash |
4 |
qwen/qwen3.7-max |
4 |
| Google: Gemini 3.6 Flash vs OpenAI: GPT-5 Nano |
google/gemini-3.6-flash |
4 |
openai/gpt-5-nano |
4 |
| Google: Gemini 3.6 Flash vs OpenAI: GPT-5.4 Mini |
google/gemini-3.6-flash |
4 |
openai/gpt-5.4-mini |
4 |
| Google: Gemini 3.6 Flash vs Qwen: Qwen3 VL 8B Instruct |
google/gemini-3.6-flash |
4 |
qwen/qwen3-vl-8b-instruct |
4 |
| Google: Gemini 3.6 Flash vs MiniMax: MiniMax M2 |
google/gemini-3.6-flash |
4 |
minimax/minimax-m2 |
4 |
| Google: Gemini 3.6 Flash vs MiniMax M2.5-highspeed |
google/gemini-3.6-flash |
4 |
minimax/minimax-m2.5-highspeed |
4 |
| DeepSeek V3 0324 vs Google: Gemini 3.6 Flash |
deepseek/deepseek-v3-0324 |
4 |
google/gemini-3.6-flash |
4 |
| Google: Gemini 3.6 Flash vs Google: Gemma 3 12B |
google/gemini-3.6-flash |
4 |
google/gemma-3-12b-it |
4 |
| Google: Gemini 3.6 Flash vs Meta: Llama 3.1 70B Instruct |
google/gemini-3.6-flash |
4 |
meta-llama/llama-3.1-70b-instruct |
4 |
| Meta: Llama 4 Maverick vs OpenAI: GPT-4.1 |
meta-llama/llama-4-maverick |
4 |
openai/gpt-4.1 |
4 |
| Meta: Llama 4 Maverick vs NVIDIA: Nemotron 3 Super |
meta-llama/llama-4-maverick |
4 |
nvidia/nemotron-3-super-120b-a12b |
4 |
| Meta: Llama 4 Maverick vs Qwen3.7-Max |
meta-llama/llama-4-maverick |
4 |
qwen/qwen3.7-max |
4 |
| Meta: Llama 4 Maverick vs OpenAI: GPT-5 Nano |
meta-llama/llama-4-maverick |
4 |
openai/gpt-5-nano |
4 |
| Meta: Llama 4 Maverick vs OpenAI: GPT-5.4 Mini |
meta-llama/llama-4-maverick |
4 |
openai/gpt-5.4-mini |
4 |
| Meta: Llama 4 Maverick vs Qwen: Qwen3 VL 8B Instruct |
meta-llama/llama-4-maverick |
4 |
qwen/qwen3-vl-8b-instruct |
4 |
| Meta: Llama 4 Maverick vs MiniMax: MiniMax M2 |
meta-llama/llama-4-maverick |
4 |
minimax/minimax-m2 |
4 |
| Meta: Llama 4 Maverick vs MiniMax M2.5-highspeed |
meta-llama/llama-4-maverick |
4 |
minimax/minimax-m2.5-highspeed |
4 |
| DeepSeek V3 0324 vs Meta: Llama 4 Maverick |
deepseek/deepseek-v3-0324 |
4 |
meta-llama/llama-4-maverick |
4 |
| Google: Gemma 3 12B vs Meta: Llama 4 Maverick |
google/gemma-3-12b-it |
4 |
meta-llama/llama-4-maverick |
4 |
| Meta: Llama 3.1 70B Instruct vs Meta: Llama 4 Maverick |
meta-llama/llama-3.1-70b-instruct |
4 |
meta-llama/llama-4-maverick |
4 |
| NVIDIA: Nemotron 3 Super vs OpenAI: GPT-4.1 |
nvidia/nemotron-3-super-120b-a12b |
4 |
openai/gpt-4.1 |
4 |
| OpenAI: GPT-4.1 vs Qwen3.7-Max |
openai/gpt-4.1 |
4 |
qwen/qwen3.7-max |
4 |
| OpenAI: GPT-4.1 vs OpenAI: GPT-5 Nano |
openai/gpt-4.1 |
4 |
openai/gpt-5-nano |
4 |
| OpenAI: GPT-4.1 vs OpenAI: GPT-5.4 Mini |
openai/gpt-4.1 |
4 |
openai/gpt-5.4-mini |
4 |
| OpenAI: GPT-4.1 vs Qwen: Qwen3 VL 8B Instruct |
openai/gpt-4.1 |
4 |
qwen/qwen3-vl-8b-instruct |
4 |
| MiniMax: MiniMax M2 vs OpenAI: GPT-4.1 |
minimax/minimax-m2 |
4 |
openai/gpt-4.1 |
4 |
| MiniMax M2.5-highspeed vs OpenAI: GPT-4.1 |
minimax/minimax-m2.5-highspeed |
4 |
openai/gpt-4.1 |
4 |
| DeepSeek V3 0324 vs OpenAI: GPT-4.1 |
deepseek/deepseek-v3-0324 |
4 |
openai/gpt-4.1 |
4 |
| Google: Gemma 3 12B vs OpenAI: GPT-4.1 |
google/gemma-3-12b-it |
4 |
openai/gpt-4.1 |
4 |
| Meta: Llama 3.1 70B Instruct vs OpenAI: GPT-4.1 |
meta-llama/llama-3.1-70b-instruct |
4 |
openai/gpt-4.1 |
4 |
| NVIDIA: Nemotron 3 Super vs Qwen3.7-Max |
nvidia/nemotron-3-super-120b-a12b |
4 |
qwen/qwen3.7-max |
4 |
| NVIDIA: Nemotron 3 Super vs OpenAI: GPT-5 Nano |
nvidia/nemotron-3-super-120b-a12b |
4 |
openai/gpt-5-nano |
4 |
| NVIDIA: Nemotron 3 Super vs OpenAI: GPT-5.4 Mini |
nvidia/nemotron-3-super-120b-a12b |
4 |
openai/gpt-5.4-mini |
4 |
| NVIDIA: Nemotron 3 Super vs Qwen: Qwen3 VL 8B Instruct |
nvidia/nemotron-3-super-120b-a12b |
4 |
qwen/qwen3-vl-8b-instruct |
4 |
| MiniMax: MiniMax M2 vs NVIDIA: Nemotron 3 Super |
minimax/minimax-m2 |
4 |
nvidia/nemotron-3-super-120b-a12b |
4 |
| MiniMax M2.5-highspeed vs NVIDIA: Nemotron 3 Super |
minimax/minimax-m2.5-highspeed |
4 |
nvidia/nemotron-3-super-120b-a12b |
4 |
| DeepSeek V3 0324 vs NVIDIA: Nemotron 3 Super |
deepseek/deepseek-v3-0324 |
4 |
nvidia/nemotron-3-super-120b-a12b |
4 |
| Google: Gemma 3 12B vs NVIDIA: Nemotron 3 Super |
google/gemma-3-12b-it |
4 |
nvidia/nemotron-3-super-120b-a12b |
4 |
| Meta: Llama 3.1 70B Instruct vs NVIDIA: Nemotron 3 Super |
meta-llama/llama-3.1-70b-instruct |
4 |
nvidia/nemotron-3-super-120b-a12b |
4 |
| OpenAI: GPT-5 Nano vs Qwen3.7-Max |
openai/gpt-5-nano |
4 |
qwen/qwen3.7-max |
4 |
| OpenAI: GPT-5.4 Mini vs Qwen3.7-Max |
openai/gpt-5.4-mini |
4 |
qwen/qwen3.7-max |
4 |
| Qwen: Qwen3 VL 8B Instruct vs Qwen3.7-Max |
qwen/qwen3-vl-8b-instruct |
4 |
qwen/qwen3.7-max |
4 |
| MiniMax: MiniMax M2 vs Qwen3.7-Max |
minimax/minimax-m2 |
4 |
qwen/qwen3.7-max |
4 |
| MiniMax M2.5-highspeed vs Qwen3.7-Max |
minimax/minimax-m2.5-highspeed |
4 |
qwen/qwen3.7-max |
4 |
| DeepSeek V3 0324 vs Qwen3.7-Max |
deepseek/deepseek-v3-0324 |
4 |
qwen/qwen3.7-max |
4 |
| Google: Gemma 3 12B vs Qwen3.7-Max |
google/gemma-3-12b-it |
4 |
qwen/qwen3.7-max |
4 |
| Meta: Llama 3.1 70B Instruct vs Qwen3.7-Max |
meta-llama/llama-3.1-70b-instruct |
4 |
qwen/qwen3.7-max |
4 |