Navigasi
Advertise here

gpt-oss-120b (medium) vs GLM 5.3 FlashX (low)

GLM 5.3 FlashX (low) unggul dalam skor rata-rata dengan 6.0 vs 5.9. gpt-oss-120b (medium) memiliki biaya benchmark lebih rendah di $0.030 vs $0.157. GLM 5.3 FlashX (low) lebih cepat di 9.69s vs 31.58s, dengan tingkat keberhasilan 47.8% vs 63.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#243
Total token output
118,831
Waktu respons (rata-rata)
31.58s
Total Biaya
$0.030
Peringkat
#238
Total token output
43,203
Waktu respons (rata-rata)
9.69s
Total Biaya
$0.157
Model yang direkomendasikan gpt-oss-120b (medium)

Its score stays close to the best score here (5.9 vs 6.0), while costing about 5.4x less than GLM 5.3 FlashX (low).

Perbandingan terperinci

Metrik gpt-oss-120b gpt-oss-120b medium Rilis: 2025-08-05 GLM 5.3 FlashX GLM 5.3 FlashX low Rilis: 2026-09-21
Skor 5.9 6.0
Peringkat #243 #238
Keandalan 10.0 10.0
Konsistensi 8.1 6.8
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 47.8% 63.8%
Tes tidak stabil 5 9
Total Run 69 69
Biaya per hasil 0.335 1.423
Total Biaya $0.030 $0.157
Harga input $0.037 / 1M $0.370 / 1M
Harga output $0.170 / 1M $1.250 / 1M
Total token input 285,293 277,028
Token output 29,565 11,965
Token penalaran 89,266 31,238
Waktu respons (rata-rata) 31.58s 9.69s
Waktu respons (maks) 203.90s 77.99s
Waktu respons (total) 536.78s 222.83s
Parameter 117B total (5.1B aktif) 320B total (18B aktif)
Ketersediaan Sumber terbuka Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#243 gpt-oss-120b

medium
Biaya
$0.001
Waktu
26.7s
Token
555 tok

#238 GLM 5.3 FlashX

low
Biaya
$0.002
Waktu
8.4s
Token
1,526 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
GLM 5.3 FlashX 5.5 7.4 44.4% 1 5.45s 7,317 382 4,760

Perbandingan Cepat

Ganti Pasangan Perbandingan