- Rang
- #158
- Totaal aantal uitvoer-tokens
- 110,125
- Responstijd (gem.)
- 56.77s
- Totale kosten
- $1.798
Ember-1 (high) vs GLM 5.1 (medium)
Ember-1 (high) leidt in gemiddelde score met 7.1 vs 7.0. GLM 5.1 (medium) heeft lagere benchmarkkosten met $1.053 vs $1.798. Ember-1 (high) is sneller met 56.77s vs 58.80s, met slagingspercentages van 71.2% vs 65.2%.
Vergeleken modellen
- Rang
- #164
- Totaal aantal uitvoer-tokens
- 215,889
- Responstijd (gem.)
- 58.80s
- Totale kosten
- $1.053
Aanbevolen model
GLM 5.1 (medium)
De score blijft dicht bij de beste score hier (7.0 vs 7.1) en het kost ongeveer 1.7x minder dan Ember-1 (high).
Gedetailleerde vergelijking
| Metriek | Ember-1 Ember-1 high | GLM 5.1 GLM 5.1 medium |
|---|---|---|
| Score | 7.1 | 7.0 |
| Rang | #158 | #164 |
| Betrouwbaarheid | 8.0 | 8.1 |
| Consistentie | 7.3 | 8.4 |
| Pogingen | 66/66 | 66/66 |
| Correcte tests | ||
| Slaagpercentage per poging | 71.2% | 65.2% |
| Instabiele tests | 7 | 4 |
| Totaal runs | 66 | 66 |
| Kosten per resultaat | 14.981 | 6.923 |
| Totale kosten | $1.798 | $1.053 |
| Invoerprijs | $3.000 / 1M | $1.400 / 1M |
| Uitvoerprijs | $15.000 / 1M | $4.400 / 1M |
| Totaal aantal invoer-tokens | 48,577 | 82,592 |
| Uitvoer-tokens | 7,345 | 16,089 |
| Redeneer-tokens | 102,780 | 199,800 |
| Responstijd (gem.) | 56.77s | 58.80s |
| Responstijd (max) | 255.06s | 308.75s |
| Responstijd (totaal) | 1248.88s | 1234.72s |
| Parameters | ~2.8T totaal (~104B actief) | 744B totaal (40B actief) |
| Beschikbaarheid | Gesloten broncode | Open-source |
Model generatie-showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#158 Ember-1
high- Kosten
- $0.038
- Tijd
- 55.1s
- Tokens
- 2,671 tok
#164 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Kosten
- $0.000
- Tijd
- 300.0s
- Tokens
- 0 tok
Topmodellen op score
Score vs totale kosten
Responstijd (gem.)
Score vs Responstijd (gem.)
Totaal aantal uitvoer-tokens
Score vs Totaal aantal uitvoer-tokens
Categorie-uitsplitsing
Snelle vergelijking
Vergelijkingspaar wisselen
GPT-5.5nonevsGLM 5.1mediumSpace Bunny AlphahighvsGLM 5.1mediumEmber-1highvsGrok 4.3mediumEmber-1highvsGPT-5.6 SolnoneEmber-1highvsGPT-6 LunalowGPT-6 LunalowvsGLM 5.1mediumDeepSeek V3.2mediumvsEmber-1highGPT-5.6 SolnonevsGLM 5.1mediumEmber-1highvsGPT-5.5noneEmber-1highvsMercury 2mediumEmber-1highvsGrok 4.20mediumClaude Fable 5.1lowvsGLM 5.1medium