Navigare
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Sonnet 5.5 (xhigh) vs GPT-6 Luna (high)

Scorul mediu este practic egal la 8.3 vs 8.3. GPT-6 Luna (high) are costul de benchmark mai mic, $0.054 vs $1.069. Claude Sonnet 5.5 (xhigh) este mai rapid cu 13.17s vs 17.53s, cu rate de reușită de 78.8% vs 75.8%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-09-29

Modele comparate

Rang
#79
Total tokenuri de ieșire
77,105
Timp de răspuns (mediu)
13.17s
Cost total
$1.069
Rang
#81
Total tokenuri de ieșire
91,405
Timp de răspuns (mediu)
17.53s
Cost total
$0.054
Model recomandat GPT-6 Luna (high)

Are cel mai bun scor aici (8.3) și costă de aproximativ 19.9x mai puțin decât Claude Sonnet 5.5 (xhigh).

Comparație detaliată

Metrică Claude Sonnet 5.5 Claude Sonnet 5.5 xhigh Lansare: 2026-09-29 GPT-6 Luna GPT-6 Luna high Lansare: 2026-09-23
Scor 8.3 8.3
Rang #79 #81
Fiabilitate 10.0 10.0
Consistență 8.7 9.0
Încercări 66/66 66/66
Teste corecte
Rată de trecere pe încercare 78.8% 75.8%
Teste instabile 4 3
Rulări totale 66 66
Cost per rezultat 7.123 0.359
Cost total $1.069 $0.054
Preț de intrare $2.000 / 1M $0.100 / 1M
Preț de ieșire $10.000 / 1M $0.500 / 1M
Total tokenuri de intrare 148,643 80,441
Tokenuri de ieșire 9,700 4,761
Tokenuri de raționament 67,405 86,644
Timp de răspuns (mediu) 13.17s 17.53s
Timp de răspuns (maxim) 54.91s 106.93s
Timp de răspuns (total) 289.67s 385.74s
Parametri ~1T în total (~100B activi) ~400B în total (~17B activi)
Disponibilitate Închis Închis

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 Claude Sonnet 5.5

xhigh
Cost
$0.319
Timp
258.6s
Tokenuri
31,969 tok

#81 GPT-6 Luna

high
Cost
$0.003
Timp
49.2s
Tokenuri
5,231 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Claude Sonnet 5.5 8.2 7.2 88.9% 1 11.90s 10,608 555 9,501
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

Comparație rapidă

Schimbă perechea de comparație