- Peringkat
- #263
- Total token output
- 272,229
- Waktu respons (rata-rata)
- 69.08s
- Total Biaya
- $0.273
MiniMax M2.5 (medium) vs gpt-oss-120b
MiniMax M2.5 (medium) unggul dalam skor rata-rata dengan 4.6 vs 3.7. gpt-oss-120b memiliki biaya benchmark lebih rendah di $0.010 vs $0.273. gpt-oss-120b lebih cepat di 21.61s vs 69.08s, dengan tingkat keberhasilan 43.9% vs 33.3%.
- Peringkat
- #285
- Total token output
- 51,664
- Waktu respons (rata-rata)
- 21.61s
- Total Biaya
- $0.010
Model yang direkomendasikan
gpt-oss-120b
It offers the best overall trade-off: a competitive score (3.7), lower cost than MiniMax M2.5 (medium), and balanced response time.
Perbandingan terperinci
| Metrik | MiniMax M2.5 MiniMax M2.5 medium | gpt-oss-120b gpt-oss-120b none Tersedia gratis |
|---|---|---|
| Skor | 4.6 | 3.7 |
| Peringkat | #263 | #285 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 6.6 | 7.8 |
| Percobaan | 66/66 | 57/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 43.9% | 33.3% |
| Tes tidak stabil | 9 | 2 |
| Total Run | 66 | 57 |
| Biaya per hasil | 6.463 | 0.168 |
| Total Biaya | $0.273 | $0.010 |
| Harga input | $0.225 / 1M | $0.030 / 1M |
| Harga output | $0.900 / 1M | $0.170 / 1M |
| Total token input | 142,621 | 9,081 |
| Token output | 20,409 | 51,664 |
| Token penalaran | 251,820 | 0 |
| Waktu respons (rata-rata) | 69.08s | 21.61s |
| Waktu respons (maks) | 251.36s | 113.71s |
| Waktu respons (total) | 1036.24s | 345.79s |
| Parameter | 230B total (10B aktif) | 117B total (5.1B aktif) |
| Ketersediaan | Bobot tersedia | Sumber terbuka |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#263 MiniMax M2.5
medium
SVG tidak valid
- Biaya
- $0.000
- Waktu
- 300.0s
- Token
- 0 tok
#285 gpt-oss-120b
none
Belum ada hasil showcase yang dihasilkan untuk model ini.
- Biaya
- T/A
- Waktu
- -
- Token
- 0 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 7.9 | 6.3 | 83.3% | 2 | 20.82s | 612 | 286 | 45,344 | |
| gpt-oss-120b | 6.5 | 10.0 | 50.0% | 0 | 32.84s | 1,336 | 8,676 | 0 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.4 | 9.1 | 0.0% | 0 | 188.58s | 6,076 | 357 | 106,177 | |
| gpt-oss-120b | 1.5 | 4.0 | 22.2% | 1 | 9.57s | 901 | 3,232 | 0 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.7 | 1.8 | 50.0% | 2 | 83.19s | 119,959 | 16,687 | 18,834 | |
| gpt-oss-120b | 1.5 | 5.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 4.6 | 1.7 | 66.7% | 2 | 7.48s | 6,584 | 266 | 3,835 | |
| gpt-oss-120b | 6.5 | 10.0 | 50.0% | 0 | 7.12s | 2,421 | 598 | 0 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 2.9 | 7.2 | 11.1% | 1 | 158.88s | 368 | 14 | 45,372 | |
| gpt-oss-120b | 3.0 | 10.0 | 0.0% | 0 | 34.98s | 1,294 | 29,483 | 0 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.8 | 2.5 | 33.3% | 1 | 6.63s | 492 | 25 | 1,686 | |
| gpt-oss-120b | 4.8 | 10.0 | 0.0% | 0 | 10.79s | 584 | 615 | 0 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 7.5 | 10.0 | 50.0% | 0 | 621ms | 699 | 156 | 1,495 | |
| gpt-oss-120b | 9.8 | 10.0 | 100.0% | 0 | 5.06s | 1,043 | 1,940 | 0 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 5.3 | 7.2 | 44.4% | 1 | 11.21s | 495 | 1,069 | 9,605 | |
| gpt-oss-120b | 6.0 | 7.2 | 55.6% | 1 | 8.21s | 1,188 | 3,982 | 0 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 10.0 | 10.0 | 100.0% | 0 | 15.35s | 7,123 | 269 | 937 | |
| gpt-oss-120b | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| MiniMax M2.5 | 3.0 | 10.0 | 0.0% | 0 | 80.79s | 213 | 1,280 | 18,535 | |
| gpt-oss-120b | 3.0 | 10.0 | 0.0% | 0 | 47.29s | 314 | 3,138 | 0 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
MiniMax M2.5mediumvsLaguna S 2.1noneTersedia gratisLing 3.0 Tinymediumvsgpt-oss-120bnoneTersedia gratisgpt-oss-120bnoneTersedia gratisvsQwen3.5-9BmediumMercury 2nonevsMiniMax M2.5mediumLing 3.0 Tinylowvsgpt-oss-120bnoneTersedia gratisLing 3.0 Tinyhighvsgpt-oss-120bnoneTersedia gratisTrinity Large PreviewnonevsMiniMax M2.5mediumMiniMax M2.5mediumvsGLM 4.7 FlashnoneKAT-Coder-Air V2.5nonevsMiniMax M2.5mediumTrinity Large ThinkinghighvsMiniMax M2.5mediumMiniMax M2.5mediumvsGPT-5.4 NanononeMiniMax M2.5mediumvsNemotron 3.5 LightninglowTersedia gratis