Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (medium) vs Qwen3.7 Max

De gemiddelde score is vrijwel gelijk met 7.4 vs 7.4. GPT-5.6 Luna (medium) heeft lagere benchmarkkosten met $0.072 vs $0.197. Qwen3.7 Max is sneller met 4.56s vs 7.43s, met slagingspercentages van 62.1% vs 68.2%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-08-29

Rang
#94
Totaal aantal uitvoer-tokens
44,525
Responstijd (gem.)
7.43s
Totale kosten
$0.072
Rang
#92
Totaal aantal uitvoer-tokens
12,446
Responstijd (gem.)
4.56s
Totale kosten
$0.197
Aanbevolen model GPT-5.6 Luna (medium)

Het heeft hier de beste score (7.4) en kost ongeveer 2.8x minder dan Qwen3.7 Max.

Gedetailleerde vergelijking

Metriek GPT-5.6 Luna GPT-5.6 Luna medium Releasedatum: 2026-07-09 Qwen3.7 Max Qwen3.7 Max none Releasedatum: 2026-05-22
Score 7.4 7.4
Rang #94 #92
Betrouwbaarheid 10.0 9.9
Consistentie 9.2 10.0
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 62.1% 68.2%
Instabiele tests 2 0
Totaal runs 66 66
Kosten per resultaat 2.601 1.581
Totale kosten $0.072 $0.197
Invoerprijs $0.200 / 1M $1.475 / 1M
Uitvoerprijs $1.200 / 1M $4.425 / 1M
Totaal aantal invoer-tokens 89,685 95,992
Uitvoer-tokens 5,701 12,446
Redeneer-tokens 38,824 0
Responstijd (gem.) 7.43s 4.56s
Responstijd (max) 29.85s 72.30s
Responstijd (totaal) 163.54s 100.30s
Parameters ~400B totaal (~17B actief) ~1T totaal (~40B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-5.6 Luna

medium
Kosten
$0.014
Tijd
14.6s
Tokens
2,362 tok

#92 Qwen3.7 Max

none
Kosten
$0.046
Tijd
195.0s
Tokens
12,171 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

Snelle vergelijking

Vergelijkingspaar wisselen