Navigatie
AI BENCHY
Advertise here

Qwen3.5-27B vs Qwen3.6 27B (medium)

De gemiddelde score is vrijwel gelijk met 6.5 vs 6.5. Qwen3.5-27B heeft lagere benchmarkkosten met $0.058 vs $0.680. Qwen3.5-27B is sneller met 4.76s vs 106.32s, met slagingspercentages van 40.9% vs 59.1%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-07-25

Rang
#113
Totaal aantal uitvoer-tokens
24,321
Responstijd (gem.)
4.76s
Totale kosten
$0.058
Rang
#109
Totaal aantal uitvoer-tokens
274,192
Responstijd (gem.)
106.32s
Totale kosten
$0.680
Aanbevolen model Qwen3.5-27B

Het heeft hier de beste score (6.5) en kost ongeveer 11.7x minder dan Qwen3.6 27B (medium).

Gedetailleerde vergelijking

Metriek Qwen3.5-27B Qwen3.5-27B none Releasedatum: 2026-02-24 Qwen3.6 27B Qwen3.6 27B medium Releasedatum: 2026-04-20
Score 6.5 6.5
Rang #113 #109
Betrouwbaarheid 10.0 10.0
Consistentie 9.3 8.0
Correcte tests
Slaagpercentage per poging 40.9% 59.1%
Instabiele tests 2 6
Totaal runs 66 66
Kosten per resultaat 0.763 7.319
Totale kosten $0.058 $0.680
Invoerprijs $0.195 / 1M $0.290 / 1M
Uitvoerprijs $1.560 / 1M $2.400 / 1M
Totaal aantal invoer-tokens 102,316 106,167
Uitvoer-tokens 24,321 32,889
Redeneer-tokens 0 241,303
Responstijd (gem.) 4.76s 106.32s
Responstijd (max) 69.46s 1085.11s
Responstijd (totaal) 104.71s 2339.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#113 Qwen3.5-27B

none
Kosten
$0.007
Tijd
42.9s
Tokens
4,273 tok

#109 Qwen3.6 27B

medium
Kosten
$0.009
Tijd
39.6s
Tokens
3,090 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

Snelle vergelijking

Vergelijkingspaar wisselen