Arena AI
Dua model, soalan yang sama, undi buta, awak yang putuskan AI mana yang lebih baik.
Masukkan prompt dan tekan Battle untuk mula
Model dipilih secara rawak dan tersembunyi
Papan Penunjuk
| # | Model | ELO | Menang | Kehilangan | Pautan | Kadar Menang |
|---|---|---|---|---|---|---|
| 1 | Mistral | 1262 | 11 | 7 | 30 | 23% |
| 2 | Qwen3 8B | 1231 | 115 | 15 | 56 | 62% |
| 3 | Kimi K2.5 | 1216 | 1 | 0 | 0 | 100% |
| 4 | Deepseek Chat V3 0324 | 1215 | 1 | 0 | 1 | 50% |
| 5 | Gpt 4O Mini | 1200 | 1 | 1 | 0 | 50% |
| 6 | Llama 3.3 70B Instruct | 1200 | 0 | 0 | 1 | 0% |
| 7 | Gemini 2.5 Pro | 1184 | 0 | 1 | 0 | 0% |
| 8 | Deepseek R1 7B | 1179 | 16 | 19 | 23 | 28% |
| 9 | Claude Sonnet 4 | 1168 | 0 | 2 | 0 | 0% |
| 10 | Qwen7B | 1146 | 18 | 101 | 64 | 10% |
225 total votes. ELO ratings update after each vote.