Navigatie
Advertise here

Ember-1 vs GPT-5.6 Luna

De gemiddelde score is vrijwel gelijk met 5.4 vs 5.3. GPT-5.6 Luna heeft lagere benchmarkkosten met $0.042 vs $0.786. GPT-5.6 Luna is sneller met 3.78s vs 22.65s, met slagingspercentages van 43.5% vs 34.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#295
Totaal aantal uitvoer-tokens
11,832
Responstijd (gem.)
22.65s
Totale kosten
$0.786
Rang
#297
Totaal aantal uitvoer-tokens
8,000
Responstijd (gem.)
3.78s
Totale kosten
$0.042
Aanbevolen model GPT-5.6 Luna

Het heeft hier de beste score (5.3) en kost ongeveer 18.9x minder dan Ember-1.

Gedetailleerde vergelijking

Metriek Ember-1 Ember-1 none Releasedatum: 2026-09-28 GPT-5.6 Luna GPT-5.6 Luna none Releasedatum: 2026-07-09
Score 5.4 5.3
Rang #295 #297
Betrouwbaarheid 8.8 10.0
Consistentie 8.6 8.8
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 43.5% 34.8%
Instabiele tests 4 3
Totaal runs 69 69
Kosten per resultaat 9.817 2.814
Totale kosten $0.786 $0.042
Invoerprijs $3.000 / 1M $0.200 / 1M
Uitvoerprijs $15.000 / 1M $1.200 / 1M
Prijs voor cachelezen $0.300 / 1M $0.020 / 1M
Prijs voor cacheschrijven n.v.t. $0.250 / 1M
Totaal aantal invoer-tokens 202,617 230,744
Uitvoer-tokens 11,832 8,000
Redeneer-tokens 0 0
Responstijd (gem.) 22.65s 3.78s
Responstijd (max) 93.12s 53.77s
Responstijd (totaal) 520.91s 86.83s
Parameters ~2.8T totaal (~104B actief) ~400B totaal (~17B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#295 Ember-1

none
Kosten
$0.156
Tijd
224.6s
Tokens
10,555 tok

#297 GPT-5.6 Luna

none
Kosten
$0.016
Tijd
15.8s
Tokens
2,685 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Ember-1 5.5 10.0 33.3% 0 1.94s 7,485 393 0
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

Vergelijkingspaar wisselen