Navigation
Advertise here

Qwen3.6 35B A3B vs Hy4 preview (low)

Hy4 preview (low) führt beim Durchschnittsscore mit 5.4 vs 5.3. Qwen3.6 35B A3B hat die niedrigeren Benchmark-Kosten mit $0.105 vs $1.844. Qwen3.6 35B A3B ist schneller mit 8.43s vs 207.21s, mit Erfolgsraten von 29.0% vs 21.7%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-07

Verglichene Modelle

Rang
#302
Gesamte Ausgabe-Token
63,781
Antwortzeit (Durchschnitt)
8.43s
Gesamtkosten
$0.105
Rang
#292
Gesamte Ausgabe-Token
687,477
Antwortzeit (Durchschnitt)
207.21s
Gesamtkosten
$1.844
Empfohlenes Modell Qwen3.6 35B A3B

Die Punktzahl bleibt nah an der besten hier (5.3 vs 5.4) und es kostet etwa 17.6x weniger als Hy4 preview (low).

Detaillierter Vergleich

Metrik Qwen3.6 35B A3B Qwen3.6 35B A3B none Veröffentlichung: 2026-04-20 Hy4 preview Hy4 preview low Veröffentlichung: 2026-08-29
Punktzahl 5.3 5.4
Rang #302 #292
Zuverlässigkeit 10.0 6.5
Konsistenz 7.9 8.2
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 29.0% 21.7%
Instabile Tests 6 4
Gesamtläufe 69 69
Kosten pro Ergebnis 2.586 61.455
Gesamtkosten $0.105 $1.844
Eingabepreis $0.150 / 1M $0.751 / 1M
Ausgabepreis $1.000 / 1M $2.251 / 1M
Preis für Cache-Lesen $0.050 / 1M $0.038 / 1M
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 272,479 162,180
Ausgabe-Token 40,677 5,030
Denk-Token 23,104 682,447
Antwortzeit (Durchschnitt) 8.43s 207.21s
Antwortzeit (Maximum) 65.61s 597.45s
Antwortzeit (Gesamt) 176.93s 4765.91s
Parameter 35B insgesamt (3B aktiv) 770B insgesamt (49B aktiv)
Verfügbarkeit Open Source Open Source

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#302 Qwen3.6 35B A3B

none
Kosten
$0.008
Zeit
30.1s
Token
6,317 tok

#292 Hy4 preview

low
Provider returned error
Kosten
$0.000
Zeit
1.1s
Token
0 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.6 35B A3B 5.5 10.0 33.3% 0 8.77s 7,911 960 10,201
Hy4 preview 5.2 8.6 0.0% 0 219.15s 6,110 135 96,407

Vergleichspaar wechseln