Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 4.8 (low) vs GPT-6 Luna (medium)

GPT-6 Luna (medium) unggul dalam skor rata-rata dengan 7.9 vs 7.8. GPT-6 Luna (medium) memiliki biaya benchmark lebih rendah di $0.031 vs $2.089. Claude Opus 4.8 (low) lebih cepat di 12.88s vs 15.87s, dengan tingkat keberhasilan 80.3% vs 72.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-23

Model yang Dibandingkan

Peringkat
#103
Total token output
52,237
Waktu respons (rata-rata)
12.88s
Total Biaya
$2.089
Peringkat
#94
Total token output
45,154
Waktu respons (rata-rata)
15.87s
Total Biaya
$0.031
Model yang direkomendasikan GPT-6 Luna (medium)

It has the best score here (7.9), while costing about 68.5x less than Claude Opus 4.8 (low).

Perbandingan terperinci

Metrik Claude Opus 4.8 Claude Opus 4.8 low Rilis: 2026-05-28 GPT-6 Luna GPT-6 Luna medium Rilis: 2026-09-23
Skor 7.8 7.9
Peringkat #103 #94
Keandalan 10.0 10.0
Konsistensi 8.9 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 80.3% 72.7%
Tes tidak stabil 3 3
Total Run 66 66
Biaya per hasil 13.054 0.218
Total Biaya $2.089 $0.031
Harga input $5.000 / 1M $0.100 / 1M
Harga output $25.000 / 1M $0.500 / 1M
Total token input 156,522 78,946
Token output 43,056 4,635
Token penalaran 9,181 40,519
Waktu respons (rata-rata) 12.88s 15.87s
Waktu respons (maks) 127.97s 35.14s
Waktu respons (total) 283.32s 349.09s
Parameter ~5T total (~500B aktif) ~400B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#103 Claude Opus 4.8

low
Biaya
$0.031
Waktu
14.1s
Token
1,345 tok

#94 GPT-6 Luna

medium
Biaya
$0.002
Waktu
23.6s
Token
2,966 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

Perbandingan Cepat

Ganti Pasangan Perbandingan