Navigasi
AI BENCHY
Advertise here

Nemotron 3 Ultra vs gpt-oss-120b (medium)

gpt-oss-120b (medium) unggul dalam skor rata-rata dengan 6.1 vs 6.1. gpt-oss-120b (medium) memiliki biaya benchmark lebih rendah di $0.020 vs $0.093. Nemotron 3 Ultra lebih cepat di 3.88s vs 20.81s, dengan tingkat keberhasilan 42.4% vs 50.0%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-04

Peringkat
#198
Total token output
9,470
Waktu respons (rata-rata)
3.88s
Total Biaya
$0.093
Peringkat
#189
Total token output
98,282
Waktu respons (rata-rata)
20.81s
Total Biaya
$0.020
Model yang direkomendasikan Nemotron 3 Ultra

Its score stays close to the best score here (6.1 vs 6.1), while responding about 5.4x faster than gpt-oss-120b (medium).

Perbandingan terperinci

Metrik Nemotron 3 Ultra Nemotron 3 Ultra none Rilis: 2026-06-04 Tersedia gratis gpt-oss-120b gpt-oss-120b medium Rilis: 2025-08-05
Skor 6.1 6.1
Peringkat #198 #189
Keandalan 10.0 10.0
Konsistensi 9.3 8.0
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 42.4% 50.0%
Tes tidak stabil 2 5
Total Run 66 66
Biaya per hasil 0.000 0.224
Total Biaya $0.093 $0.020
Harga input $0.625 / 1M $0.037 / 1M
Harga output $3.125 / 1M $0.170 / 1M
Total token input 101,168 108,767
Token output 9,470 29,378
Token penalaran 0 68,904
Waktu respons (rata-rata) 3.88s 20.81s
Waktu respons (maks) 37.50s 68.16s
Waktu respons (total) 85.33s 332.88s
Parameter 550B total (55B aktif) 117B total (5.1B aktif)
Ketersediaan Bobot tersedia Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#198 Nemotron 3 Ultra

none
Biaya
$0.000
Waktu
149.6s
Token
3,405 tok

#189 gpt-oss-120b

medium
Biaya
$0.001
Waktu
26.7s
Token
555 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Nemotron 3 Ultra 5.5 10.0 33.3% 0 1.02s 7,623 369 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

Perbandingan Cepat

Ganti Pasangan Perbandingan