Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (low) vs Qwen3.5-122B-A10B (medium)

Qwen3.5-122B-A10B (medium) leidt in gemiddelde score met 7.0 vs 6.9. GPT-5.6 Luna (low) heeft lagere benchmarkkosten met $0.075 vs $1.152. GPT-5.6 Luna (low) is sneller met 6.96s vs 66.96s, met slagingspercentages van 56.5% vs 71.0%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-01

Vergeleken modellen

Rang
#165
Totaal aantal uitvoer-tokens
28,001
Responstijd (gem.)
6.96s
Totale kosten
$0.075
Rang
#158
Totaal aantal uitvoer-tokens
522,190
Responstijd (gem.)
66.96s
Totale kosten
$1.152
Aanbevolen model GPT-5.6 Luna (low)

De score blijft dicht bij de beste score hier (6.9 vs 7.0) en het kost ongeveer 15.5x minder dan Qwen3.5-122B-A10B (medium).

Gedetailleerde vergelijking

Metriek GPT-5.6 Luna GPT-5.6 Luna low Releasedatum: 2026-07-09 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Releasedatum: 2026-02-24
Score 6.9 7.0
Rang #165 #158
Betrouwbaarheid 10.0 10.0
Consistentie 8.3 8.3
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 56.5% 71.0%
Instabiele tests 5 5
Totaal runs 69 69
Kosten per resultaat 2.428 9.196
Totale kosten $0.075 $1.152
Invoerprijs $0.200 / 1M $0.260 / 1M
Uitvoerprijs $1.200 / 1M $2.080 / 1M
Totaal aantal invoer-tokens 202,680 251,695
Uitvoer-tokens 9,230 49,415
Redeneer-tokens 18,771 472,775
Responstijd (gem.) 6.96s 66.96s
Responstijd (max) 45.74s 519.30s
Responstijd (totaal) 160.19s 1539.99s
Parameters ~400B totaal (~17B actief) 122B totaal (10B actief)
Beschikbaarheid Gesloten broncode Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#165 GPT-5.6 Luna

low
Kosten
$0.011
Tijd
10.2s
Tokens
1,897 tok

#158 Qwen3.5-122B-A10B

medium
Kosten
$0.019
Tijd
48.7s
Tokens
6,034 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

Snelle vergelijking

Vergelijkingspaar wisselen