- Rang
- #79
- Totaal aantal uitvoer-tokens
- 108,019
- Responstijd (gem.)
- 27.64s
- Totale kosten
- $0.241
GPT-5 Mini (medium) vs Qwen3.8 2.4T A95B (low)
De gemiddelde score is vrijwel gelijk met 8.1 vs 8.1. GPT-5 Mini (medium) heeft lagere benchmarkkosten met $0.241 vs $2.672. GPT-5 Mini (medium) is sneller met 27.64s vs 118.97s, met slagingspercentages van 65.2% vs 72.7%.
Vergeleken modellen
- Rang
- #78
- Totaal aantal uitvoer-tokens
- 495,541
- Responstijd (gem.)
- 118.97s
- Totale kosten
- $2.672
Aanbevolen model
GPT-5 Mini (medium)
Het heeft hier de beste score (8.1) en kost ongeveer 11.1x minder dan Qwen3.8 2.4T A95B (low).
Gedetailleerde vergelijking
| Metriek | GPT-5 Mini GPT-5 Mini medium | Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low |
|---|---|---|
| Score | 8.1 | 8.1 |
| Rang | #79 | #78 |
| Betrouwbaarheid | 10.0 | 9.4 |
| Consistentie | 8.4 | 9.2 |
| Pogingen | 66/66 | 66/66 |
| Correcte tests | ||
| Slaagpercentage per poging | 65.2% | 72.7% |
| Instabiele tests | 4 | 2 |
| Totaal runs | 66 | 66 |
| Kosten per resultaat | 2.006 | 17.812 |
| Totale kosten | $0.241 | $2.672 |
| Invoerprijs | $0.250 / 1M | $2.000 / 1M |
| Uitvoerprijs | $2.000 / 1M | $6.000 / 1M |
| Totaal aantal invoer-tokens | 98,383 | 113,279 |
| Uitvoer-tokens | 14,409 | 121,045 |
| Redeneer-tokens | 93,610 | 374,496 |
| Responstijd (gem.) | 27.64s | 118.97s |
| Responstijd (max) | 111.48s | 534.21s |
| Responstijd (totaal) | 608.02s | 2617.41s |
| Parameters | ~400B totaal (~17B actief) | 2.4T totaal (95B actief) |
| Beschikbaarheid | Gesloten broncode | Gewichten beschikbaar |
Model generatie-showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#79 GPT-5 Mini
medium- Kosten
- $0.007
- Tijd
- 42.9s
- Tokens
- 3,432 tok
#78 Qwen3.8 2.4T A95B
low- Kosten
- $0.100
- Tijd
- 193.2s
- Tokens
- 16,767 tok
Topmodellen op score
Score vs totale kosten
Responstijd (gem.)
Score vs Responstijd (gem.)
Totaal aantal uitvoer-tokens
Score vs Totaal aantal uitvoer-tokens
Categorie-uitsplitsing
| Anti-AI-trucs | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 7.1 | 7.6 | 66.7% | 1 | 13.86s | 606 | 1,715 | 6,378 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 22.04s | 1,104 | 397 | 4,814 |
| Programmeren | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 27.63s | 7,302 | 658 | 17,152 | |
| Qwen3.8 2.4T A95B | 7.8 | 9.3 | 66.7% | 0 | 172.53s | 6,716 | 21,405 | 57,399 |
| Gecombineerd | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 7.3 | 5.8 | 83.3% | 1 | 99.82s | 75,392 | 8,387 | 35,328 | |
| Qwen3.8 2.4T A95B | 8.2 | 6.9 | 66.7% | 1 | 231.85s | 85,267 | 8,008 | 50,681 |
| Gegevensparsering en extractie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 12.58s | 7,140 | 453 | 3,200 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 22.27s | 7,956 | 839 | 2,445 |
| Domeinspecifiek | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 3.5 | 4.4 | 33.3% | 2 | 44.66s | 524 | 268 | 16,128 | |
| Qwen3.8 2.4T A95B | 3.2 | 9.3 | 0.0% | 0 | 287.65s | 1,008 | 16,133 | 156,114 |
| Algemene intelligentie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 4.5 | 10.0 | 0.0% | 0 | 13.50s | 477 | 349 | 1,856 | |
| Qwen3.8 2.4T A95B | 6.1 | 3.1 | 66.7% | 1 | 22.97s | 606 | 44 | 1,497 |
| Instructies opvolgen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 11.59s | 660 | 310 | 3,968 | |
| Qwen3.8 2.4T A95B | 9.8 | 10.0 | 100.0% | 0 | 19.54s | 903 | 263 | 1,480 |
| Puzzeloplossing | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 5.6 | 9.8 | 33.3% | 0 | 15.20s | 642 | 1,622 | 6,144 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 43.37s | 1,026 | 1,154 | 25,563 |
| Toolaanroepen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 18.64s | 5,445 | 487 | 1,600 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 25.88s | 8,481 | 302 | 975 |
| Algemene kennis | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 3.0 | 10.0 | 0.0% | 0 | 9.99s | 195 | 160 | 1,856 | |
| Qwen3.8 2.4T A95B | 3.0 | 10.0 | 0.0% | 0 | 422.46s | 212 | 72,500 | 73,528 |
Snelle vergelijking
Vergelijkingspaar wisselen
Muse Glimmer 30BxhighvsGPT-5 MinimediumMuse Glimmer 30BxhighvsQwen3.8 2.4T A95BlowGPT-5 MinimediumvsInklinghighQwen3.8 2.4T A95BlowvsGrok 4.7mediumMuse Spark 1.1highvsGPT-5 MinimediumQwen3.8 2.4T A95BlowvsInklinghighMuse Spark 1.1highvsQwen3.8 2.4T A95BlowDeepSeek V4 Flash 0731lowvsGPT-5 MinimediumDeepSeek V4 Flash 0731highvsGPT-5 MinimediumDeepSeek V4 Flash 0731highvsQwen3.8 2.4T A95BlowGPT-5 MinimediumvsGLM 5.2highClaude Sonnet 5mediumvsQwen3.8 2.4T A95Blow