AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Kategoriefehler

Domänenspezifisch: Zusätzliche Formatierung

Domänenspezifisch
Zusätzliche Formatierung

Sieh, welche KI-Modelle bei Domänenspezifisch am ehesten auf Zusätzliche Formatierung stoßen, damit du Schwachstellen schneller erkennst.

Angezeigte Modelle

7

Gesamtfehler

8

Am stärksten betroffenes Modell

Claude Opus 4.6 2
Rang Modell Unternehmen Zusätzliche Formatierung-Anzahl Kategorie-Score Korrekte Tests Antwortzeit (Durchschnitt)
#37 Claude Opus 4.6 medium Anthropic 2 3.0 0/3 83.4s
#26 Claude Sonnet 4.6 medium Anthropic 1 2.9 0/3 0ms
#35 MiMo-V2-Omni medium Xiaomi 1 3.0 0/3 55.1s
#47 Grok 4.20 medium X AI 1 5.3 1/3 27.0s
#50 Hunter Alpha medium OpenRouter 1 3.0 0/3 10.5s
#56 Grok 4.20 Multi Agent Beta medium X AI 1 2.9 0/3 24.7s
#82 Grok 4.20 none X AI 1 3.0 0/3 687ms

Top-Modelle nach Zusätzliche Formatierung-Anzahl

Zusätzliche Formatierung-Anzahl vs Punktzahl

Top-Modelle nach Antwortzeit (Durchschnitt)

Top-Modelle nach Geschätzte verschwendete Kosten