Arena AI
Dua model, soalan yang sama, undi buta, awak yang putuskan AI mana yang lebih baik.
Masukkan prompt dan tekan Battle untuk mula
Model dipilih secara rawak dan tersembunyi
Papan Pemimpin
| # | Model | ELO | Menang | Kehilangan | Pautan | Kadar Menang |
|---|---|---|---|---|---|---|
| 1 | Kimi K2.5 | 1216 | 1 | 0 | 0 | 100% |
| 2 | Deepseek Chat V3 0324 | 1215 | 1 | 0 | 1 | 50% |
| 3 | Deepseek R1 7B | 1203 | 33 | 39 | 38 | 30% |
| 4 | Gpt 4O Mini | 1200 | 1 | 1 | 0 | 50% |
| 5 | Llama 3.3 70B Instruct | 1200 | 0 | 0 | 1 | 0% |
| 6 | Qwen3 8B | 1198 | 140 | 29 | 73 | 58% |
| 7 | Mistral | 1191 | 20 | 18 | 39 | 26% |
| 8 | Gemini 2.5 Pro | 1184 | 0 | 1 | 0 | 0% |
| 9 | Claude Sonnet 4 | 1168 | 0 | 2 | 0 | 0% |
| 10 | Qwen7B | 1134 | 33 | 122 | 75 | 14% |
317 total votes. ELO ratings update after each vote.