- Peringkat
- #28
- Total token output
- 125,316
- Waktu respons (rata-rata)
- 38.97s
- Total Biaya
- $4.163
GPT-5.5 (medium) vs Pareto
GPT-5.5 (medium) unggul dalam skor rata-rata dengan 9.0 vs 8.9. Pareto memiliki biaya benchmark lebih rendah di $1.172 vs $4.163. Pareto lebih cepat di 31.51s vs 38.97s, dengan tingkat keberhasilan 87.9% vs 86.4%.
Model yang Dibandingkan
- Peringkat
- #34
- Total token output
- 119,230
- Waktu respons (rata-rata)
- 31.51s
- Total Biaya
- $1.172
Model yang direkomendasikan
Pareto
Its score stays close to the best score here (8.9 vs 9.0), while costing about 3.6x less than GPT-5.5 (medium).
Perbandingan terperinci
| Metrik | GPT-5.5 GPT-5.5 medium | Pareto Pareto none |
|---|---|---|
| Skor | 9.0 | 8.9 |
| Peringkat | #28 | #34 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 8.9 | 9.2 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 87.9% | 86.4% |
| Tes tidak stabil | 3 | 2 |
| Total Run | 66 | 66 |
| Biaya per hasil | 23.127 | 6.506 |
| Total Biaya | $4.163 | $1.172 |
| Harga input | $5.000 / 1M | $2.500 / 1M |
| Harga output | $30.000 / 1M | $7.500 / 1M |
| Total token input | 80,668 | 110,734 |
| Token output | 5,617 | 119,230 |
| Token penalaran | 119,699 | 0 |
| Waktu respons (rata-rata) | 38.97s | 31.51s |
| Waktu respons (maks) | 332.10s | 143.33s |
| Waktu respons (total) | 857.43s | 693.29s |
| Parameter | ~1.5T total (~100B aktif) | - |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#28 GPT-5.5
medium- Biaya
- $0.112
- Waktu
- 71.9s
- Token
- 3,807 tok
#34 Pareto
none- Biaya
- $0.034
- Waktu
- 170.7s
- Token
- 4,581 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
Perbandingan Cepat
Ganti Pasangan Perbandingan
Seed 2.1 TurbohighvsParetononeMuse Spark 1.3highvsParetononeClaude Fable 5.1highvsGPT-5.5mediumGPT-5.3-CodexmediumvsParetononeGPT-5.5mediumvsGrok 4.5highQwen3.8 Max (0902)highvsParetononeGPT-5.5mediumvsQwen3.8 Max (0902)highParetononevsGrok 4.5highMuse Spark 1.3highvsGPT-5.5mediumGemini 3.5 FlashlowvsParetononeQwen3.8 MaxmediumvsParetononeSeed 2.1 TurbolowvsGPT-5.5medium