AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#382

D1

Liquid Veröffentlichung: 2026-10-02 Getestet am: 2026-10-02 10:20 liquid/d1::none
-SonstigeGeschlossen

Zusammenfassung

D1 erreicht 1.9 bei AI BENCHY und liegt auf #382. Das Modell hat 10.0 Zuverlässigkeit, 11.6% Erfolgsrate, $0.003 Gesamtkosten und 508ms durchschnittliche Antwortzeit.

Modelldaten

Recherchiert am 2026-10-02

Parameter
-
Architektur
Sonstige
Verfügbarkeit
Geschlossen
Lizenz
-

Punktzahl

1.9

Konsistenz

4.9

Gesamte Ausgabe-Token

0

Gesamte Eingabe-Token

55,956

Eingabepreis

$0.040 / 1M

Ausgabepreis

$0.000 / 1M

Preis für Cache-Lesen

$0.040 / 1M

Preis für Cache-Schreiben

k. A.

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Korrekte Tests

Falsche Tests: 10

Erfolgsquote pro Versuch: 11.6%

Benchmark-Abdeckung: 36/69 Versuche. Adapter liefern die Auswahlmöglichkeiten. Unterstützt 12/23 Tests. Andere Tests werden nicht unterstützt und gelten nicht als fehlgeschlagen. Die Bewertung nutzt die gesamte Testsuite.

Instabile Tests

1

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

508ms

Antwortzeit (Maximum): 820ms

Antwortzeit (Gesamt): 6.10s

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Agentenaufgaben 0.0 0.0
Anti-KI-Tricks 4.0 7.5
Programmierung 2.2 6.7
Kombiniert 0.0 0.0
Datenanalyse und -extraktion 6.5 10.0
Domänenspezifisch 3.6 7.2
Allgemeine Intelligenz 0.0 0.0
Befolgung von Anweisungen 1.5 5.0
Rätsellösen 1.7 3.3
Werkzeugaufrufe 0.0 0.0
Allgemeinwissen 0.0 0.0

Verglichene Modelle