Navigasi
AI BENCHY
Advertise here

Nemotron 3.5 Lightning (high) vs GPT-5.6 Luna

Nemotron 3.5 Lightning (high) unggul dalam skor rata-rata dengan 5.6 vs 5.4. GPT-5.6 Luna memiliki biaya benchmark lebih rendah di $0.015 vs $0.168. GPT-5.6 Luna lebih cepat di 1.50s vs 58.26s, dengan tingkat keberhasilan 50.0% vs 36.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-15

Peringkat
#208
Total token output
654,597
Waktu respons (rata-rata)
58.26s
Total Biaya
$0.168
Peringkat
#216
Total token output
6,709
Waktu respons (rata-rata)
1.50s
Total Biaya
$0.015
Model yang direkomendasikan GPT-5.6 Luna

Its score stays close to the best score here (5.4 vs 5.6), while costing about 11.8x less than Nemotron 3.5 Lightning (high).

Perbandingan terperinci

Metrik Nemotron 3.5 Lightning Nemotron 3.5 Lightning high Rilis: 2026-08-11 Tersedia gratis GPT-5.6 Luna GPT-5.6 Luna none Rilis: 2026-07-09
Skor 5.6 5.4
Peringkat #208 #216
Keandalan 9.9 10.0
Konsistensi 5.6 8.8
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 50.0% 36.4%
Tes tidak stabil 12 3
Total Run 66 66
Biaya per hasil 0.000 2.357
Total Biaya $0.168 $0.015
Harga input $0.100 / 1M $0.100 / 1M
Harga output $0.250 / 1M $0.600 / 1M
Total token input 118,016 101,332
Token output 148,344 6,709
Token penalaran 506,253 0
Waktu respons (rata-rata) 58.26s 1.50s
Waktu respons (maks) 285.26s 10.57s
Waktu respons (total) 1281.79s 33.05s
Parameter 30B total (3B aktif) ~400B total (~17B aktif)
Ketersediaan Bobot tersedia Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 Nemotron 3.5 Lightning

high
Biaya
$0.000
Waktu
92.8s
Token
11,343 tok

#216 GPT-5.6 Luna

none
Biaya
$0.016
Waktu
15.8s
Token
2,685 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Nemotron 3.5 Lightning 4.4 5.1 33.3% 2 168.41s 7,623 68,533 242,319
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

Perbandingan Cepat

Ganti Pasangan Perbandingan