Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

MiniMax M2.5 (medium) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) leidt in gemiddelde score met 9.6 vs 4.3. MiniMax M2.5 (medium) heeft lagere benchmarkkosten met $0.440 vs $0.460. GPT-6.1 Sol (low) is sneller met 7.15s vs 102.32s, met slagingspercentages van 42.0% vs 92.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-03

Vergeleken modellen

Rang
#348
Totaal aantal uitvoer-tokens
290,496
Responstijd (gem.)
102.32s
Totale kosten
$0.440
Rang
#16
Totaal aantal uitvoer-tokens
13,138
Responstijd (gem.)
7.15s
Totale kosten
$0.460
Aanbevolen model GPT-6.1 Sol (low)

Het heeft hier de beste score (9.6) en reageert ongeveer 14.3x sneller dan MiniMax M2.5 (medium).

Gedetailleerde vergelijking

Metriek MiniMax M2.5 MiniMax M2.5 medium Releasedatum: 2026-02-12 GPT-6.1 Sol GPT-6.1 Sol low Releasedatum: 2026-09-29
Score 4.3 9.6
Rang #348 #16
Betrouwbaarheid 9.3 10.0
Consistentie 6.8 9.6
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 42.0% 92.8%
Instabiele tests 9 1
Totaal runs 69 69
Kosten per resultaat 7.104 2.187
Totale kosten $0.440 $0.460
Invoerprijs $0.270 / 1M $2.000 / 1M
Uitvoerprijs $1.080 / 1M $10.000 / 1M
Prijs voor cachelezen $0.027 / 1M $0.100 / 1M
Prijs voor cacheschrijven n.v.t. $2.500 / 1M
Totaal aantal invoer-tokens 188,239 163,900
Uitvoer-tokens 27,822 4,958
Redeneer-tokens 262,674 8,180
Responstijd (gem.) 102.32s 7.15s
Responstijd (max) 600.81s 46.57s
Responstijd (totaal) 1637.05s 164.47s
Parameters 230B totaal (10B actief) ~2T totaal (~150B actief)
Beschikbaarheid Gewichten beschikbaar Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#348 MiniMax M2.5

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

#16 GPT-6.1 Sol

low
Kosten
$0.028
Tijd
44.6s
Tokens
2,881 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

Snelle vergelijking

Vergelijkingspaar wisselen