KI-Arena
Zwei Modelle, dieselbe prompte, blinde Stimme. Sie entscheiden, welche KI besser ist.
Geben Sie eine Eingabeaufforderung ein und drücken Sie Battle, um zu starten
Modelle werden zufällig und versteckt gewählt
Leitplan
| # | Modell | ELO | Gewinne | Verluste | Krawatten | Gewinnrate |
|---|---|---|---|---|---|---|
| 1 | Kimi K2.5 | 1216 | 1 | 0 | 0 | 100% |
| 2 | Deepseek Chat V3 0324 | 1215 | 1 | 0 | 1 | 50% |
| 3 | Deepseek R1 7B | 1203 | 33 | 39 | 38 | 30% |
| 4 | Gpt 4O Mini | 1200 | 1 | 1 | 0 | 50% |
| 5 | Llama 3.3 70B Instruct | 1200 | 0 | 0 | 1 | 0% |
| 6 | Qwen3 8B | 1198 | 140 | 29 | 73 | 58% |
| 7 | Mistral | 1191 | 20 | 18 | 39 | 26% |
| 8 | Gemini 2.5 Pro | 1184 | 0 | 1 | 0 | 0% |
| 9 | Claude Sonnet 4 | 1168 | 0 | 2 | 0 | 0% |
| 10 | Qwen7B | 1134 | 33 | 122 | 75 | 14% |
317 total votes. ELO ratings update after each vote.