#85 Qwen3.7 Max
none- Kosten
- $0.046
- Tijd
- 195.0s
- Tokens
- 12,171 tok
AI BENCHY Compare
Samenvatting
GLM 5 Turbo (medium) leidt in gemiddelde score met 8.4 vs 6.9. Qwen3.7 Max heeft lagere benchmarkkosten met $0.054 vs $0.323. Qwen3.7 Max is sneller met 1.30s vs 23.00s, met slagingspercentages van 66.7% vs 74.6%.
Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-07-14
| Metriek | Qwen3.7 Max Qwen3.7 Max none | GLM 5 Turbo GLM 5 Turbo medium |
|---|---|---|
| Score | 6.9 | 8.4 |
| Rang | #85 | #24 |
| Betrouwbaarheid | 10.0 | 10.0 |
| Consistentie | 10.0 | 8.5 |
| Correcte tests | ||
| Slaagpercentage per poging | 66.7% | 74.6% |
| Instabiele tests | 0 | 4 |
| Totaal runs | 63 | 63 |
| Kosten per resultaat | 0.744 | 2.011 |
| Totale kosten | $0.054 | $0.323 |
| Invoerprijs | $1.250 / 1M | $1.200 / 1M |
| Uitvoerprijs | $3.750 / 1M | $4.000 / 1M |
| Totaal aantal invoer-tokens | 37,107 | 35,593 |
| Uitvoer-tokens | 1,994 | 12,245 |
| Redeneer-tokens | 0 | 62,277 |
| Responstijd (gem.) | 1.30s | 23.00s |
| Responstijd (max) | 3.92s | 194.23s |
| Responstijd (totaal) | 27.21s | 482.97s |
Generatie-showcase
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| Programmeren | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 5.5 | 10.0 | 33.3% | 0 | 1.35s | 7,911 | 582 | 0 | |
| GLM 5 Turbo | 8.2 | 9.3 | 66.7% | 0 | 45.90s | 5,941 | 363 | 25,381 |
Vergelijkingspaar wisselen