Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4 Pro 0423 vs GPT-5.6 Luna (medium)

GPT-5.6 Luna (medium) leidt in gemiddelde score met 7.4 vs 7.4. GPT-5.6 Luna (medium) heeft lagere benchmarkkosten met $0.101 vs $0.311. GPT-5.6 Luna (medium) is sneller met 9.64s vs 14.05s, met slagingspercentages van 49.3% vs 62.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-01

Vergeleken modellen

Rang
#129
Totaal aantal uitvoer-tokens
46,004
Responstijd (gem.)
14.05s
Totale kosten
$0.311
Rang
#122
Totaal aantal uitvoer-tokens
47,986
Responstijd (gem.)
9.64s
Totale kosten
$0.101
Aanbevolen model GPT-5.6 Luna (medium)

Het heeft hier de beste score (7.4) en kost ongeveer 3.1x minder dan DeepSeek V4 Pro 0423.

Gedetailleerde vergelijking

Metriek DeepSeek V4 Pro 0423 DeepSeek V4 Pro 0423 none Releasedatum: 2026-04-24 GPT-5.6 Luna GPT-5.6 Luna medium Releasedatum: 2026-07-09
Score 7.4 7.4
Rang #129 #122
Betrouwbaarheid 10.0 10.0
Consistentie 8.7 9.0
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 49.3% 62.3%
Instabiele tests 4 3
Totaal runs 69 69
Kosten per resultaat 2.341 2.822
Totale kosten $0.311 $0.101
Invoerprijs $0.783 / 1M $0.200 / 1M
Uitvoerprijs $1.566 / 1M $1.200 / 1M
Totaal aantal invoer-tokens 304,186 212,780
Uitvoer-tokens 46,004 6,849
Redeneer-tokens 0 41,137
Responstijd (gem.) 14.05s 9.64s
Responstijd (max) 119.44s 58.09s
Responstijd (totaal) 323.17s 221.62s
Parameters 1.6T totaal (49B actief) ~400B totaal (~17B actief)
Beschikbaarheid Open-source Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#129 DeepSeek V4 Pro 0423

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

#122 GPT-5.6 Luna

medium
Kosten
$0.014
Tijd
14.6s
Tokens
2,362 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 0423 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

Snelle vergelijking

Vergelijkingspaar wisselen