Navigasi
Advertise here

GPT-6 Luna Decisions (default) vs Tev1 4B Experimental (default)

GPT-6 Luna Decisions (default) unggul dalam skor rata-rata dengan 2.4 vs 1.0. Tev1 4B Experimental (default) memiliki biaya benchmark lebih rendah di $0.002 vs $0.005. GPT-6 Luna Decisions (default) lebih cepat di 495ms vs 498ms, dengan tingkat keberhasilan 13.0% vs 13.0%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#390
Total token output
0
Waktu respons (rata-rata)
495ms
Total Biaya
$0.005
Peringkat
#397
Total token output
96
Waktu respons (rata-rata)
498ms
Total Biaya
$0.002
Model yang direkomendasikan GPT-6 Luna Decisions (default)

It has the strongest score in this comparison (2.4) and the best overall balance of cost and response time across all 2 models.

Perbandingan terperinci

Metrik GPT-6 Luna Decisions GPT-6 Luna Decisions default Rilis: 2026-10-07 Tev1 4B Experimental Tev1 4B Experimental default Rilis: 2026-09-30
Skor 2.4 1.0
Peringkat #390 #397
Keandalan 10.0 10.0
Konsistensi 5.2 3.0
Percobaan 36/69 21/69
Tes benar
Tingkat lulus per percobaan 13.0% 13.0%
Tes tidak stabil 0 0
Total Run 36 21
Biaya per hasil 0.159 0.048
Total Biaya $0.005 $0.002
Harga input $0.100 / 1M $0.042 / 1M
Harga output $0.000 / 1M $0.000 / 1M
Harga baca cache $0.000 / 1M T/A
Harga tulis cache $0.000 / 1M T/A
Total token input 47,583 33,864
Token output 0 96
Token penalaran 0 0
Waktu respons (rata-rata) 495ms 498ms
Waktu respons (maks) 842ms 602ms
Waktu respons (total) 5.94s 3.49s
Parameter ~400B total (~17B aktif) 4B
Ketersediaan Tertutup Bobot tersedia

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Tev1 4B Experimental 0.0 0.0 0.0% 0 0ms 0 0 0

Perbandingan Cepat

Ganti Pasangan Perbandingan

Command A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsTev1 4B ExperimentaldefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20noneLing 3.0 TinymediumvsGPT-6 Luna DecisionsdefaultLing 3.0 TinylowvsGPT-6 Luna DecisionsdefaultLing 3.0 TinyhighvsGPT-6 Luna DecisionsdefaultNemotron 3.5 LightningnoneTersedia gratisvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsQwen3.5-9Bmedium