- Peringkat
- #263
- Total token output
- 27,928
- Waktu respons (rata-rata)
- 54.36s
- Total Biaya
- $0.012
Granite 4.2 8B (low) vs Mercury 2.5 (low)
Skor rata-rata hampir imbang di 5.1 vs 5.1. Mercury 2.5 (low) memiliki biaya benchmark lebih rendah di $0.011 vs $0.012. Mercury 2.5 (low) lebih cepat di 1.35s vs 54.36s, dengan tingkat keberhasilan 31.8% vs 39.4%.
Model yang Dibandingkan
- Peringkat
- #265
- Total token output
- 33,719
- Waktu respons (rata-rata)
- 1.35s
- Total Biaya
- $0.011
Model yang direkomendasikan
Mercury 2.5 (low)
It has the best score here (5.1), while responding about 40.2x faster than Granite 4.2 8B (low).
Perbandingan terperinci
| Metrik | Granite 4.2 8B Granite 4.2 8B low | Mercury 2.5 Mercury 2.5 low |
|---|---|---|
| Skor | 5.1 | 5.1 |
| Peringkat | #263 | #265 |
| Keandalan | 9.0 | 9.8 |
| Konsistensi | 10.0 | 8.1 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 31.8% | 39.4% |
| Tes tidak stabil | 0 | 5 |
| Total Run | 66 | 66 |
| Biaya per hasil | 0.167 | 0.177 |
| Total Biaya | $0.012 | $0.011 |
| Harga input | $0.100 / 1M | $0.040 / 1M |
| Harga output | $0.150 / 1M | $0.150 / 1M |
| Total token input | 74,721 | 138,020 |
| Token output | 9,205 | 6,083 |
| Token penalaran | 18,723 | 27,636 |
| Waktu respons (rata-rata) | 54.36s | 1.35s |
| Waktu respons (maks) | 566.80s | 7.48s |
| Waktu respons (total) | 1195.97s | 29.74s |
| Parameter | 8B | ~100B |
| Ketersediaan | Sumber terbuka | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#263 IBM: Granite 4.2 8B
low
Provider returned error
- Biaya
- $0.000
- Waktu
- 0.2s
- Token
- 0 tok
#265 Mercury 2.5
low- Biaya
- $0.001
- Waktu
- 2.4s
- Token
- 1,236 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 8.3 | 10.0 | 75.0% | 0 | 11.68s | 777 | 1,463 | 898 | |
| Mercury 2.5 | 6.9 | 7.9 | 66.7% | 1 | 799ms | 772 | 209 | 2,969 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 5.5 | 10.0 | 33.3% | 0 | 13.01s | 8,439 | 2,469 | 2,984 | |
| Mercury 2.5 | 5.5 | 10.0 | 33.3% | 0 | 972ms | 7,909 | 521 | 2,269 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 298.21s | 46,805 | 4,085 | 13,637 | |
| Mercury 2.5 | 3.0 | 10.0 | 0.0% | 0 | 5.16s | 107,683 | 3,750 | 11,351 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 6.5 | 10.0 | 50.0% | 0 | 1.39s | 7,683 | 270 | 75 | |
| Mercury 2.5 | 6.5 | 10.0 | 50.0% | 0 | 1.06s | 8,322 | 739 | 1,499 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 5.3 | 10.0 | 33.3% | 0 | 26.16s | 876 | 154 | 290 | |
| Mercury 2.5 | 3.6 | 7.2 | 22.2% | 1 | 846ms | 851 | 57 | 2,265 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 4.0 | 10.0 | 0.0% | 0 | 659ms | 561 | 108 | 24 | |
| Mercury 2.5 | 4.4 | 9.9 | 0.0% | 0 | 819ms | 525 | 99 | 748 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 75.80s | 402 | 84 | 378 | |
| Mercury 2.5 | 2.9 | 6.0 | 16.7% | 1 | 972ms | 518 | 48 | 1,026 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 90.84s | 517 | 181 | 82 | |
| Mercury 2.5 | 5.9 | 4.5 | 66.7% | 2 | 792ms | 768 | 249 | 2,214 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 10.0 | 10.0 | 100.0% | 0 | 2.23s | 8,412 | 358 | 265 | |
| Mercury 2.5 | 9.8 | 10.0 | 100.0% | 0 | 2.72s | 10,440 | 388 | 2,537 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 5.53s | 249 | 33 | 90 | |
| Mercury 2.5 | 3.0 | 10.0 | 0.0% | 0 | 782ms | 232 | 23 | 758 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Granite 4.2 8BlowvsMistral Small 4mediumGranite 4.2 8BlowvsMistral Small 4noneGranite 4.2 8BlowvsNemotron 3.5 LightningmediumTersedia gratisMercury 2.5lowvsQwen3 Coder NextnoneGranite 4.2 8BlowvsQwen3 Coder NextnoneMercury 2.5lowvsMistral Small 4mediumMercury 2.5lowvsMistral Small 4noneMercury 2.5lowvsNemotron 3.5 LightningmediumTersedia gratisMercury 2.5lowvsMiMo-V2.5noneMercury 2.5lowvsQwen3.5-9BnoneGranite 4.2 8BlowvsMiMo-V2.5noneNorth Mini CodenoneTersedia gratisvsMercury 2.5low