Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna vs Qwen3.8 27B

Qwen3.8 27B leidt in gemiddelde score met 5.5 vs 5.4. De kosten van de lokale hardware zijn niet gemeten. Daarom zijn kostenvergelijkingen niet beschikbaar. GPT-5.6 Luna is sneller met 1.50s vs 3.12s, met slagingspercentages van 36.4% vs 40.9%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-08-15

Rang
#216
Totaal aantal uitvoer-tokens
6,709
Responstijd (gem.)
1.50s
Totale kosten
$0.015
Rang
#211
Totaal aantal uitvoer-tokens
11,445
Responstijd (gem.)
3.12s
Totale kosten
n.v.t.
Aanbevolen model GPT-5.6 Luna

De score blijft dicht bij de beste score hier (5.4 vs 5.5) en het reageert ongeveer 2.1x sneller dan Qwen3.8 27B.

Gedetailleerde vergelijking

Metriek GPT-5.6 Luna GPT-5.6 Luna none Releasedatum: 2026-07-09 Qwen3.8 27B Qwen3.8 27B none Releasedatum: 2026-08-14
Score 5.4 5.5
Rang #216 #211
Betrouwbaarheid 10.0 10.0
Consistentie 8.8 10.0
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 36.4% 40.9%
Instabiele tests 3 0
Totaal runs 66 66
Kosten per resultaat 2.357 n.v.t.
Totale kosten $0.015 n.v.t.
Invoerprijs $0.100 / 1M n.v.t.
Uitvoerprijs $0.600 / 1M n.v.t.
Totaal aantal invoer-tokens 101,332 122,463
Uitvoer-tokens 6,709 11,445
Redeneer-tokens 0 0
Responstijd (gem.) 1.50s 3.12s
Responstijd (max) 10.57s 44.76s
Responstijd (totaal) 33.05s 68.69s
Parameters ~400B totaal (~17B actief) 27.3B
Beschikbaarheid Gesloten broncode Gewichten beschikbaar

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#216 GPT-5.6 Luna

none
Kosten
$0.016
Tijd
15.8s
Tokens
2,685 tok

#211 Qwen3.8 27B

none
Kosten
n.v.t.
Tijd
23.9s
Tokens
1,922 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

Snelle vergelijking

Vergelijkingspaar wisselen