- Rang
- #390
- Totaal aantal uitvoer-tokens
- 0
- Responstijd (gem.)
- 495ms
- Totale kosten
- $0.005
GPT-6 Luna Decisions (default) vs Tev1 4B Experimental (default)
GPT-6 Luna Decisions (default) leidt in gemiddelde score met 2.4 vs 1.0. Tev1 4B Experimental (default) heeft lagere benchmarkkosten met $0.002 vs $0.005. GPT-6 Luna Decisions (default) is sneller met 495ms vs 498ms, met slagingspercentages van 13.0% vs 13.0%.
Vergeleken modellen
- Rang
- #397
- Totaal aantal uitvoer-tokens
- 96
- Responstijd (gem.)
- 498ms
- Totale kosten
- $0.002
Aanbevolen model
GPT-6 Luna Decisions (default)
Het heeft de sterkste score in deze vergelijking (2.4) en de beste balans tussen kosten en responstijd over alle 2 modellen.
Gedetailleerde vergelijking
| Metriek | GPT-6 Luna Decisions GPT-6 Luna Decisions default | Tev1 4B Experimental Tev1 4B Experimental default |
|---|---|---|
| Score | 2.4 | 1.0 |
| Rang | #390 | #397 |
| Betrouwbaarheid | 10.0 | 10.0 |
| Consistentie | 5.2 | 3.0 |
| Pogingen | 36/69 | 21/69 |
| Correcte tests | ||
| Slaagpercentage per poging | 13.0% | 13.0% |
| Instabiele tests | 0 | 0 |
| Totaal runs | 36 | 21 |
| Kosten per resultaat | 0.159 | 0.048 |
| Totale kosten | $0.005 | $0.002 |
| Invoerprijs | $0.100 / 1M | $0.042 / 1M |
| Uitvoerprijs | $0.000 / 1M | $0.000 / 1M |
| Prijs voor cachelezen | $0.000 / 1M | n.v.t. |
| Prijs voor cacheschrijven | $0.000 / 1M | n.v.t. |
| Totaal aantal invoer-tokens | 47,583 | 33,864 |
| Uitvoer-tokens | 0 | 96 |
| Redeneer-tokens | 0 | 0 |
| Responstijd (gem.) | 495ms | 498ms |
| Responstijd (max) | 842ms | 602ms |
| Responstijd (totaal) | 5.94s | 3.49s |
| Parameters | ~400B totaal (~17B actief) | 4B |
| Beschikbaarheid | Gesloten broncode | Gewichten beschikbaar |
Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.
Topmodellen op score
Score vs totale kosten
Responstijd (gem.)
Score vs Responstijd (gem.)
Totaal aantal uitvoer-tokens
Score vs Totaal aantal uitvoer-tokens
Categorie-uitsplitsing
| Agenttaken | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Anti-AI-trucs | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 2.3 | 7.5 | 0.0% | 0 | 436ms | 6,279 | 0 | 0 | |
| Tev1 4B Experimental | 2.5 | 2.5 | 25.0% | 0 | 602ms | 507 | 6 | 0 |
| Programmeren | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 2.5 | 6.7 | 0.0% | 0 | 447ms | 22,197 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Gecombineerd | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Gegevensparsering en extractie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 10.0 | 10.0 | 100.0% | 0 | 411ms | 10,998 | 0 | 0 | |
| Tev1 4B Experimental | 3.0 | 10.0 | 0.0% | 0 | 509ms | 25,317 | 30 | 0 |
| Domeinspecifiek | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 5.3 | 10.0 | 33.3% | 0 | 554ms | 3,063 | 0 | 0 | |
| Tev1 4B Experimental | 6.7 | 6.7 | 66.7% | 0 | 440ms | 1,086 | 12 | 0 |
| Algemene intelligentie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Instructies opvolgen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 1.5 | 5.0 | 0.0% | 0 | 842ms | 4,440 | 0 | 0 | |
| Tev1 4B Experimental | 1.5 | 5.0 | 0.0% | 0 | 555ms | 6,411 | 42 | 0 |
| Puzzeloplossing | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 1.7 | 3.3 | 0.0% | 0 | 414ms | 606 | 0 | 0 | |
| Tev1 4B Experimental | 1.7 | 3.3 | 0.0% | 0 | 432ms | 543 | 6 | 0 |
| Toolaanroepen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Algemene kennis | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
Snelle vergelijking
Vergelijkingspaar wisselen
Command A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsTev1 4B ExperimentaldefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20noneLing 3.0 TinymediumvsGPT-6 Luna DecisionsdefaultLing 3.0 TinylowvsGPT-6 Luna DecisionsdefaultLing 3.0 TinyhighvsGPT-6 Luna DecisionsdefaultNemotron 3.5 LightningnoneGratis beschikbaarvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsQwen3.5-9Bmedium