Allgemeinwissen-Ranking
Sieh, welche KI-Modelle bei Allgemeinwissen am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Gesamtkosten ↓.
Angezeigte Modelle
15
Durchschnittlicher Wert für Allgemeinwissen-Score
3.2
Bestes Modell
Grok 4.20 Multi Agent Beta 0.0
250/250
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Allgemeinwissen-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #160 | Trinity Large Thinking medium | Arcee AI | 3.0 | 6.0 | $0.792 | 0/1 | 97.4s |
| #93 | Grok 4.3 medium | X AI | 3.0 | 7.1 | $0.779 | 0/1 | 44.5s |
| #95 | Grok 4.20 medium | X AI | 3.0 | 7.1 | $0.777 | 0/1 | 63.5s |
| #68 | Nemotron 3 Ultra medium | NVIDIA | 3.0 | 7.5 | $0.774 | 0/1 | 38.5s |
| #74 | GPT-5.4 Mini medium | OpenAI | 3.0 | 7.5 | $0.756 | 0/1 | 30.1s |
| #157 | Grok 4.20 Beta medium | X AI | 0.0 | 6.0 | $0.750 | 0/0 | 0ms |
| #111 | Qwen3.6 35B A3B medium | Qwen | 3.0 | 6.7 | $0.746 | 0/1 | 32.9s |
| #88 | Kimi K2.6 medium | Moonshot AI | 3.0 | 7.2 | $0.746 | 0/1 | 130.3s |
| #3 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.742 | 1/1 | 5.50s | |
| #106 | Qwen3.6 Flash medium | Qwen | 3.0 | 6.9 | $0.738 | 0/1 | 122.9s |
| #14 | Qwen3.8 Max medium | Qwen | 3.0 | 9.1 | $0.728 | 0/1 | 11.5s |
| #24 | Qwen3.8 Max low | Qwen | 3.0 | 8.7 | $0.687 | 0/1 | 12.4s |
| #70 | Kimi K2.7 Code medium | Moonshot AI | 3.0 | 7.5 | $0.686 | 0/1 | 341.8s |
| #161 | Mimo V2 Omni medium | Xiaomi | 3.0 | 5.9 | $0.683 | 0/1 | 234.2s |
| #81 | Claude Sonnet 4.6 none | Anthropic | 3.0 | 7.3 | $0.661 | 0/1 | 4.67s |