AI BENCHY
Advertise here
#42

Qwen3.8 27B

Qwen Veröffentlichung: 2026-08-14 Getestet am: 2026-08-15 04:08 qwen/qwen3.8-27b::high
27.3BSonstigeGewichte verfügbar

Zusammenfassung

Qwen3.8 27B erreicht 8.4 bei AI BENCHY und liegt auf #42. Das Modell hat 9.6 Zuverlässigkeit, 77.3% Erfolgsrate, k. A. Gesamtkosten und 167.89s durchschnittliche Antwortzeit.

Was Qwen3.8 27B besonders macht: Es nutzt ungewöhnlich viele Reasoning-Tokens, was langsamere oder teurere Läufe erklären kann.

Modelldaten

Recherchiert am 2026-08-14

Angegeben
Parameter
27.3B
Architektur
Sonstige
Verfügbarkeit
Gewichte verfügbar
Lizenz
Apache-2.0

Punktzahl

8.4

Konsistenz

9.2

Gesamtkosten (aktueller Preis)

k. A.

Gesamte Ausgabe-Token

656,635

Gesamte Eingabe-Token

100,179

Eingabepreis

k. A.

Ausgabepreis

k. A.

Korrekte Tests

Falsche Tests: 6

Erfolgsquote pro Versuch: 77.3%

Instabile Tests

2

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

167.89s

Antwortzeit (Maximum): 640.85s

Antwortzeit (Gesamt): 3693.54s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Qwen3.8 27B

high
Kosten
k. A.
Zeit
270.1s
Token
18,963 tok

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Anti-KI-Tricks 10.0 10.0
Programmierung 8.1 7.0
Kombiniert 10.0 10.0
Datenanalyse und -extraktion 10.0 10.0
Domänenspezifisch 5.3 10.0
Allgemeine Intelligenz 5.0 10.0
Befolgung von Anweisungen 9.8 10.0
Rätsellösen 7.6 7.2
Werkzeugaufrufe 10.0 10.0
Allgemeinwissen 3.0 10.0

Verglichene Modelle