AI BENCHY Kategorie
Anti-KI-Tricks-Ranking
Sieh, welche KI-Modelle bei Anti-KI-Tricks am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Korrekte Tests ↑.
Angezeigte Modelle
15
Durchschnittlicher Wert für Anti-KI-Tricks-Score
6.9
Bestes Modell
Gemini 2.5 Flash 3.0| Rang | Modell | Unternehmen | Anti-KI-Tricks-Score | Punktzahl | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|
| #96 | Ring-2.6-1T none | Inclusionai | 9.2 | 6.2 | 3/4 | 43.3s |
| #100 | Grok Build 0.1 none | X AI | 8.7 | 6.0 | 3/4 | 6.30s |
| #102 | Gemma 4 26B A4B none | 8.3 | 6.0 | 3/4 | 1.28s | |
| #105 | Nemotron 3 Super medium | NVIDIA | 8.3 | 5.8 | 3/4 | 7.85s |
| #119 | Cobuddy medium | Baidu | 8.7 | 5.6 | 3/4 | 10.00s |
| #1 | Gemini 3 Flash Preview medium | 10.0 | 9.8 | 4/4 | 3.88s | |
| #2 | Gemini 3.5 Flash high | 10.0 | 9.6 | 4/4 | 2.57s | |
| #3 | Gemini 3.5 Flash low | 10.0 | 9.4 | 4/4 | 2.52s | |
| #4 | Gemini 3.1 Pro Preview medium | 10.0 | 9.4 | 4/4 | 7.90s | |
| #5 | Qwen3.7 Max medium | Qwen | 10.0 | 9.1 | 4/4 | 6.36s |
| #6 | GPT-5.5 low | OpenAI | 10.0 | 9.0 | 4/4 | 4.41s |
| #7 | Gemini 3.5 Flash medium | 10.0 | 9.0 | 4/4 | 2.09s | |
| #9 | GPT-5.5 medium | OpenAI | 10.0 | 8.8 | 4/4 | 4.66s |
| #10 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.7 | 4/4 | 3.95s |
| #12 | Gemini 3.1 Flash Lite Preview high | 10.0 | 8.6 | 3/3 | 43.9s |