Zusammenfassung
D1 erreicht 1.9 bei AI BENCHY und liegt auf #382. Das Modell hat 10.0 Zuverlässigkeit, 11.6% Erfolgsrate, $0.003 Gesamtkosten und 508ms durchschnittliche Antwortzeit.
Modelldaten
Recherchiert am 2026-10-02
- Parameter
- -
- Architektur
- Sonstige
- Verfügbarkeit
- Geschlossen
- Lizenz
- -
1.9
Konsistenz
4.9
10.0
Gesamte Ausgabe-Token
0
Gesamte Eingabe-Token
55,956
Eingabepreis
$0.040 / 1M
Ausgabepreis
$0.000 / 1M
Preis für Cache-Lesen
$0.040 / 1M
Preis für Cache-Schreiben
k. A.
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Falsche Tests: 10
Erfolgsquote pro Versuch: 11.6%
Benchmark-Abdeckung: 36/69 Versuche. Adapter liefern die Auswahlmöglichkeiten. Unterstützt 12/23 Tests. Andere Tests werden nicht unterstützt und gelten nicht als fehlgeschlagen. Die Bewertung nutzt die gesamte Testsuite.
Instabile Tests
1
Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).
Diagramme
Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.
Punktzahl vs Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Schnellvergleich
Kategorieaufschlüsselung
| Kategorie | Punktzahl | Konsistenz | Korrekte Tests |
|---|---|---|---|
| Agentenaufgaben | 0.0 | 0.0 | |
| Anti-KI-Tricks | 4.0 | 7.5 | |
| Programmierung | 2.2 | 6.7 | |
| Kombiniert | 0.0 | 0.0 | |
| Datenanalyse und -extraktion | 6.5 | 10.0 | |
| Domänenspezifisch | 3.6 | 7.2 | |
| Allgemeine Intelligenz | 0.0 | 0.0 | |
| Befolgung von Anweisungen | 1.5 | 5.0 | |
| Rätsellösen | 1.7 | 3.3 | |
| Werkzeugaufrufe | 0.0 | 0.0 | |
| Allgemeinwissen | 0.0 | 0.0 |