Navigation
Advertise here

Qwen3.8 27B vs Inkling Small (low)

Qwen3.8 27B führt beim Durchschnittsscore mit 5.4 vs 5.2. Qwen3.8 27B hat die niedrigeren Benchmark-Kosten mit ~$0.010 vs $0.055. Inkling Small (low) ist schneller mit 1.99s vs 5.05s, mit Erfolgsraten von 39.1% vs 47.8%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-03

Verglichene Modelle

Rang
#279
Gesamte Ausgabe-Token
13,791
Antwortzeit (Durchschnitt)
5.05s
Gesamtkosten
~$0.010
Rang
#292
Gesamte Ausgabe-Token
14,686
Antwortzeit (Durchschnitt)
1.99s
Gesamtkosten
$0.055
Empfohlenes Modell Qwen3.8 27B

Es hat hier die beste Punktzahl (5.4) und kostet etwa 5.7x weniger als Inkling Small (low).

Detaillierter Vergleich

Metrik Qwen3.8 27B Qwen3.8 27B none Veröffentlichung: 2026-08-14 Kostenlos verfügbar Inkling Small Inkling Small low Veröffentlichung: 2026-08-01 Kostenlos verfügbar
Punktzahl 5.4 5.2
Rang #279 #292
Zuverlässigkeit 10.0 10.0
Konsistenz 10.0 8.7
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 39.1% 47.8%
Instabile Tests 0 4
Gesamtläufe 69 69
Kosten pro Ergebnis ~0.107 0.649
Gesamtkosten ~$0.010 $0.055
Eingabepreis k. A. $0.450 / 1M
Ausgabepreis k. A. $1.200 / 1M
Preis für Cache-Lesen k. A. $0.100 / 1M
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 281,460 81,447
Ausgabe-Token 13,791 2,715
Denk-Token 0 11,971
Antwortzeit (Durchschnitt) 5.05s 1.99s
Antwortzeit (Maximum) 47.42s 5.82s
Antwortzeit (Gesamt) 116.11s 45.67s
Parameter 27.3B 276B insgesamt (12B aktiv)
Verfügbarkeit Gewichte verfügbar Geschlossen

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#279 Qwen3.8 27B

none
Kosten
~$0.001
Zeit
23.9s
Token
1,922 tok

#292 Thinking Machines: Inkling Small

low
Kosten
$0.001
Zeit
5.9s
Token
759 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0
Inkling Small 4.6 5.0 33.3% 2 3.70s 7,374 375 4,332

Schnellvergleich

Vergleichspaar wechseln