Navigasi
Advertise here

Gemini 2.5 Flash (medium) vs GPT-6 Luna (high)

Skor rata-rata hampir imbang di 8.2 vs 8.3. GPT-6 Luna (high) memiliki biaya benchmark lebih rendah di $0.054 vs $0.644. GPT-6 Luna (high) lebih cepat di 17.53s vs 21.14s, dengan tingkat keberhasilan 71.2% vs 75.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-23

Model yang Dibandingkan

Peringkat
#75
Total token output
241,365
Waktu respons (rata-rata)
21.14s
Total Biaya
$0.644
Peringkat
#73
Total token output
91,405
Waktu respons (rata-rata)
17.53s
Total Biaya
$0.054
Model yang direkomendasikan GPT-6 Luna (high)

It has the best score here (8.3), while costing about 12.0x less than Gemini 2.5 Flash (medium).

Perbandingan terperinci

Metrik Gemini 2.5 Flash Gemini 2.5 Flash medium Rilis: 2025-06-17 GPT-6 Luna GPT-6 Luna high Rilis: 2026-09-23
Skor 8.2 8.3
Peringkat #75 #73
Keandalan 10.0 10.0
Konsistensi 9.6 9.0
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 71.2% 75.8%
Tes tidak stabil 1 3
Total Run 66 66
Biaya per hasil 4.288 0.359
Total Biaya $0.644 $0.054
Harga input $0.300 / 1M $0.100 / 1M
Harga output $2.500 / 1M $0.500 / 1M
Total token input 132,507 80,441
Token output 12,739 4,761
Token penalaran 228,626 86,644
Waktu respons (rata-rata) 21.14s 17.53s
Waktu respons (maks) 140.50s 106.93s
Waktu respons (total) 465.10s 385.74s
Parameter ~350B total (~20B aktif) ~400B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 Gemini 2.5 Flash

medium
No output was saved. The original provider response or failure reason is unavailable.
Biaya
$0.000
Waktu
274.0s
Token
0 tok

#73 GPT-6 Luna

high
Biaya
$0.003
Waktu
49.2s
Token
5,231 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 2.5 Flash 7.8 10.0 66.7% 0 41.01s 6,669 543 32,303
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

Perbandingan Cepat

Ganti Pasangan Perbandingan