- Rang
- #25
- Totaal aantal uitvoer-tokens
- 226,102
- Responstijd (gem.)
- 44.32s
- Totale kosten
- $1.157
Qwen3.7 Max (medium) vs Qwen3.8 Max (0902) (low)
Qwen3.8 Max (0902) (low) leidt in gemiddelde score met 9.1 vs 9.1. Qwen3.8 Max (0902) (low) heeft lagere benchmarkkosten met $0.664 vs $1.157. Qwen3.8 Max (0902) (low) is sneller met 24.21s vs 44.32s, met slagingspercentages van 86.4% vs 86.4%.
- Rang
- #23
- Totaal aantal uitvoer-tokens
- 75,865
- Responstijd (gem.)
- 24.21s
- Totale kosten
- $0.664
Aanbevolen model
Qwen3.8 Max (0902) (low)
Het heeft hier de beste score (9.1) en kost ongeveer 1.7x minder dan Qwen3.7 Max (medium).
Gedetailleerde vergelijking
| Metriek | Qwen3.7 Max Qwen3.7 Max medium | Qwen3.8 Max (0902) Qwen3.8 Max (0902) low |
|---|---|---|
| Score | 9.1 | 9.1 |
| Rang | #25 | #23 |
| Betrouwbaarheid | 10.0 | 10.0 |
| Consistentie | 9.0 | 9.3 |
| Pogingen | 66/66 | 66/66 |
| Correcte tests | ||
| Slaagpercentage per poging | 86.4% | 86.4% |
| Instabiele tests | 3 | 2 |
| Totaal runs | 66 | 66 |
| Kosten per resultaat | 8.904 | 3.684 |
| Totale kosten | $1.157 | $0.664 |
| Invoerprijs | $1.475 / 1M | $2.000 / 1M |
| Uitvoerprijs | $4.425 / 1M | $6.000 / 1M |
| Totaal aantal invoer-tokens | 106,029 | 103,954 |
| Uitvoer-tokens | 5,748 | 6,322 |
| Redeneer-tokens | 220,354 | 69,543 |
| Responstijd (gem.) | 44.32s | 24.21s |
| Responstijd (max) | 556.06s | 207.79s |
| Responstijd (totaal) | 975.11s | 532.62s |
| Parameters | ~1T totaal (~40B actief) | 2.4T totaal (~100B actief) |
| Beschikbaarheid | Gesloten broncode | Gesloten broncode |
Model generatie-showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#25 Qwen3.7 Max
medium- Kosten
- $0.017
- Tijd
- 68.8s
- Tokens
- 4,526 tok
#23 Qwen3.8 Max (0902)
low- Kosten
- $0.014
- Tijd
- 41.2s
- Tokens
- 2,421 tok
Topmodellen op score
Score vs totale kosten
Responstijd (gem.)
Score vs Responstijd (gem.)
Totaal aantal uitvoer-tokens
Score vs Totaal aantal uitvoer-tokens
Categorie-uitsplitsing
| Anti-AI-trucs | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.36s | 672 | 222 | 8,742 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.72s | 984 | 212 | 1,854 |
| Programmeren | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 35.31s | 7,893 | 423 | 34,808 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 37.42s | 8,127 | 485 | 17,404 |
| Gecombineerd | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 8.7 | 6.9 | 83.3% | 1 | 287.83s | 78,594 | 3,985 | 96,450 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 113.88s | 74,767 | 4,562 | 29,335 |
| Gegevensparsering en extractie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.80s | 7,782 | 270 | 6,254 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 9.94s | 7,938 | 261 | 2,254 |
| Domeinspecifiek | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 4.1 | 4.4 | 44.5% | 2 | 52.45s | 780 | 61 | 41,143 | |
| Qwen3.8 Max (0902) | 5.3 | 7.2 | 44.4% | 1 | 34.93s | 1,014 | 45 | 13,881 |
| Algemene intelligentie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 11.70s | 516 | 135 | 4,457 | |
| Qwen3.8 Max (0902) | 6.1 | 3.1 | 66.7% | 1 | 8.91s | 594 | 120 | 820 |
| Instructies opvolgen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 7.46s | 699 | 102 | 5,452 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.32s | 855 | 90 | 866 |
| Puzzeloplossing | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.84s | 696 | 259 | 8,908 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.49s | 930 | 275 | 1,248 |
| Toolaanroepen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.63s | 8,193 | 267 | 1,220 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.73s | 8,463 | 249 | 126 |
| Algemene kennis | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.7 Max | 3.0 | 10.0 | 0.0% | 0 | 33.37s | 204 | 24 | 12,920 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 13.28s | 282 | 23 | 1,755 |
Snelle vergelijking
Vergelijkingspaar wisselen
Gemini 3.8 FlashmediumvsQwen3.8 Max (0902)lowClaude Fable 5.1highvsQwen3.7 MaxmediumSeed 2.1 TurbolowvsQwen3.7 MaxmediumQwen3.7 MaxmediumvsGrok 4.5highClaude Opus 5mediumvsQwen3.8 Max (0902)lowClaude Opus 5highvsQwen3.8 Max (0902)lowClaude Fable 5.1highvsQwen3.8 Max (0902)lowGemini 3.5 FlashmediumvsQwen3.8 Max (0902)lowGPT-5.5mediumvsQwen3.8 Max (0902)lowGemini 3.1 Pro PreviewmediumvsQwen3.8 Max (0902)lowMuse Spark 1.3highvsQwen3.7 MaxmediumSeed 2.1 TurbohighvsQwen3.7 Maxmedium