- Rang
- #348
- Total tokenuri de ieșire
- 290,496
- Timp de răspuns (mediu)
- 102.32s
- Cost total
- $0.440
MiniMax M2.5 (medium) vs GPT-6.1 Sol (low)
GPT-6.1 Sol (low) conduce la scorul mediu cu 9.6 vs 4.3. MiniMax M2.5 (medium) are costul de benchmark mai mic, $0.440 vs $0.460. GPT-6.1 Sol (low) este mai rapid cu 7.15s vs 102.32s, cu rate de reușită de 42.0% vs 92.8%.
Modele comparate
- Rang
- #16
- Total tokenuri de ieșire
- 13,138
- Timp de răspuns (mediu)
- 7.15s
- Cost total
- $0.460
Model recomandat
GPT-6.1 Sol (low)
Are cel mai bun scor aici (9.6) și răspunde de aproximativ 14.3x mai rapid decât MiniMax M2.5 (medium).
Comparație detaliată
| Metrică | MiniMax M2.5 MiniMax M2.5 medium | GPT-6.1 Sol GPT-6.1 Sol low |
|---|---|---|
| Scor | 4.3 | 9.6 |
| Rang | #348 | #16 |
| Fiabilitate | 9.3 | 10.0 |
| Consistență | 6.8 | 9.6 |
| Încercări | 69/69 | 69/69 |
| Teste corecte | ||
| Rată de trecere pe încercare | 42.0% | 92.8% |
| Teste instabile | 9 | 1 |
| Rulări totale | 69 | 69 |
| Cost per rezultat | 7.104 | 2.187 |
| Cost total | $0.440 | $0.460 |
| Preț de intrare | $0.270 / 1M | $2.000 / 1M |
| Preț de ieșire | $1.080 / 1M | $10.000 / 1M |
| Preț citire cache | $0.027 / 1M | $0.100 / 1M |
| Preț scriere cache | N/D | $2.500 / 1M |
| Total tokenuri de intrare | 188,239 | 163,900 |
| Tokenuri de ieșire | 27,822 | 4,958 |
| Tokenuri de raționament | 262,674 | 8,180 |
| Timp de răspuns (mediu) | 102.32s | 7.15s |
| Timp de răspuns (maxim) | 600.81s | 46.57s |
| Timp de răspuns (total) | 1637.05s | 164.47s |
| Parametri | 230B în total (10B activi) | ~2T în total (~150B activi) |
| Disponibilitate | Ponderi disponibile | Închis |
Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.
Prezentare generare modele
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#348 MiniMax M2.5
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Cost
- $0.000
- Timp
- 300.0s
- Tokenuri
- 0 tok
#16 GPT-6.1 Sol
low- Cost
- $0.028
- Timp
- 44.6s
- Tokenuri
- 2,881 tok
Top modele după scor
Scor vs cost total
Timp de răspuns (mediu)
Scor vs Timp de răspuns (mediu)
Total tokenuri de ieșire
Scor vs Total tokenuri de ieșire
Defalcare pe categorii
| Sarcini agentice | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.0 | 10.0 | 0.0% | 0 | 600.81s | 45,618 | 7,413 | 10,854 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 46.57s | 85,882 | 798 | 461 |
| Trucuri anti-AI | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 7.9 | 6.3 | 83.3% | 2 | 20.82s | 612 | 286 | 45,344 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.14s | 606 | 147 | 226 |
| Programare | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.4 | 9.1 | 0.0% | 0 | 188.58s | 6,076 | 357 | 106,177 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 4.48s | 7,302 | 388 | 1,286 |
| Combinat | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.7 | 1.8 | 50.0% | 2 | 83.19s | 119,959 | 16,687 | 18,834 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 10.94s | 54,810 | 2,619 | 370 |
| Parsare și extragere de date | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 4.6 | 1.7 | 66.7% | 2 | 7.48s | 6,584 | 266 | 3,835 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 1.94s | 7,140 | 222 | 0 |
| Specific domeniului | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 2.9 | 7.2 | 11.1% | 1 | 158.88s | 368 | 14 | 45,372 | |
| GPT-6.1 Sol | 7.7 | 10.0 | 66.7% | 0 | 15.39s | 732 | 69 | 5,195 |
| Inteligență generală | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.8 | 2.5 | 33.3% | 1 | 6.63s | 492 | 25 | 1,686 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 3.66s | 477 | 114 | 142 |
| Respectarea instrucțiunilor | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 7.5 | 10.0 | 50.0% | 0 | 621ms | 699 | 156 | 1,495 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.21s | 660 | 93 | 115 |
| Rezolvare de puzzle-uri | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 5.3 | 7.2 | 44.4% | 1 | 11.21s | 495 | 1,069 | 9,605 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.19s | 642 | 232 | 88 |
| Apelare instrumente | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 10.0 | 10.0 | 100.0% | 0 | 15.35s | 7,123 | 269 | 937 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 5.53s | 5,454 | 246 | 0 |
| Cultură generală | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.0 | 10.0 | 0.0% | 0 | 80.79s | 213 | 1,280 | 18,535 | |
| GPT-6.1 Sol | 2.8 | 1.6 | 33.3% | 1 | 3.80s | 195 | 30 | 297 |
Comparație rapidă
Schimbă perechea de comparație
Gemini 3 Flash PreviewmediumvsGPT-6.1 SollowGemini 3.7 FlashmediumvsGPT-6.1 SollowMercury 2nonevsMiniMax M2.5mediumMiniMax M2.5mediumvsgpt-oss-120bnoneGranite 4.2 8BnonevsMiniMax M2.5mediumTrinity Large PreviewnoneDisponibil gratuitvsMiniMax M2.5mediumKAT Coder AIR V2.5nonevsMiniMax M2.5mediumClaude Opus 5.5highvsGPT-6.1 SollowMercury 2.5nonevsMiniMax M2.5mediumMiniMax M2.5mediumvsNemotron 3 SupernoneDisponibil gratuitClaude Opus 5highvsGPT-6.1 SollowRing 2.6 1tnonevsMiniMax M2.5medium