Navigatie
Advertise here

GPT-5.4 (medium) vs Qwen3.8 27B (high)

GPT-5.4 (medium) leidt in gemiddelde score met 8.8 vs 8.7. Qwen3.8 27B (high) heeft lagere benchmarkkosten met ~$0.298 vs $2.006. GPT-5.4 (medium) is sneller met 24.81s vs 166.34s, met slagingspercentages van 78.3% vs 78.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-01

Vergeleken modellen

Rang
#50
Totaal aantal uitvoer-tokens
96,502
Responstijd (gem.)
24.81s
Totale kosten
$2.006
Rang
#55
Totaal aantal uitvoer-tokens
677,080
Responstijd (gem.)
166.34s
Totale kosten
~$0.298
Aanbevolen model Qwen3.8 27B (high)

De score blijft dicht bij de beste score hier (8.7 vs 8.8) en het kost ongeveer 6.7x minder dan GPT-5.4 (medium).

Gedetailleerde vergelijking

Metriek GPT-5.4 GPT-5.4 medium Releasedatum: 2026-03-05 Qwen3.8 27B Qwen3.8 27B high Releasedatum: 2026-08-14 Gratis beschikbaar
Score 8.8 8.7
Rang #50 #55
Betrouwbaarheid 10.0 9.7
Consistentie 8.7 9.2
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 78.3% 78.3%
Instabiele tests 4 2
Totaal runs 69 69
Kosten per resultaat 12.535 ~1.751
Totale kosten $2.006 ~$0.298
Invoerprijs $2.500 / 1M n.v.t.
Uitvoerprijs $15.000 / 1M n.v.t.
Totaal aantal invoer-tokens 223,210 348,967
Uitvoer-tokens 7,312 1,005
Redeneer-tokens 89,190 676,075
Responstijd (gem.) 24.81s 166.34s
Responstijd (max) 100.41s 640.85s
Responstijd (totaal) 570.60s 3825.81s
Parameters ~1.5T totaal (~100B actief) 27.3B
Beschikbaarheid Gesloten broncode Gewichten beschikbaar

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 GPT-5.4

medium
Kosten
$0.214
Tijd
199.6s
Tokens
14,349 tok

#55 Qwen3.8 27B

high
Kosten
~$0.008
Tijd
270.1s
Tokens
18,963 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

Snelle vergelijking

Vergelijkingspaar wisselen

GPT-5.2mediumvsQwen3.8 27BhighGratis beschikbaarQwen3.8 27BhighGratis beschikbaarvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighGratis beschikbaarGPT-6 SollowvsQwen3.8 27BhighGratis beschikbaarGPT-5.4mediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-5.4mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighGratis beschikbaarMuse Spark 1.2lowvsQwen3.8 27BhighGratis beschikbaarMuse Spark 1.2lowvsGPT-5.4mediumDeepSeek V4.1 FlashmediumvsQwen3.8 27BhighGratis beschikbaarMuse Spark 1.1lowvsQwen3.8 27BhighGratis beschikbaarClaude Sonnet 5.5xhighvsQwen3.8 27BhighGratis beschikbaar