#217 Hy4 preview
low- Kosten
- $0.000
- Zeit
- 1.1s
- Token
- 0 tok
Zusammenfassung
Hy4 preview erreicht 5.6 bei AI BENCHY und liegt auf #217. Das Modell hat 5.4 Zuverlässigkeit, 19.7% Erfolgsrate, $1.745 Gesamtkosten und 214.25s durchschnittliche Antwortzeit.
Was Hy4 preview besonders macht: Am stärksten ist es in Allgemeine Intelligenz, wo es #1 erreicht; am schwächsten ist Kombiniert mit #11. Es nutzt ungewöhnlich viele Reasoning-Tokens, was langsamere oder teurere Läufe erklären kann.
Recherchiert am 2026-08-29
5.6
Konsistenz
8.5
Gesamte Ausgabe-Token
682,538
Gesamte Eingabe-Token
45,154
Eingabepreis
$0.834 / 1M
Ausgabepreis
$2.501 / 1M
Instabile Tests
3
Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Testverlauf
| Getestet am | Punktzahl | Zuverlässigkeit | Korrekte Tests | Gesamtkosten | Vergleichen |
|---|---|---|---|---|---|
| 2026-08-29 15:57 Erneuter Test | 5.1 | 3.6 | $1.681 | Aktueller Lauf | |
| 2026-08-29 14:28 Erster Lauf | 4.3 | 1.6 | $1.433 | Vergleichen |
Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.
| Kategorie | Punktzahl | Konsistenz | Korrekte Tests |
|---|---|---|---|
| Anti-KI-Tricks | 6.0 | 8.9 | |
| Programmierung | 5.2 | 8.6 | |
| Kombiniert | 2.9 | 5.8 | |
| Datenanalyse und -extraktion | 8.7 | 10.0 | |
| Domänenspezifisch | 4.5 | 10.0 | |
| Allgemeine Intelligenz | 7.5 | 10.0 | |
| Befolgung von Anweisungen | 9.8 | 10.0 | |
| Rätsellösen | 5.3 | 5.0 | |
| Werkzeugaufrufe | 3.0 | 10.0 | |
| Allgemeinwissen | 3.0 | 10.0 |