Navigasi
AI BENCHY
Advertise here

DeepSeek V4 Flash 0731 (low) vs Gemini 2.5 Flash (medium)

Gemini 2.5 Flash (medium) unggul dalam skor rata-rata dengan 8.2 vs 8.2. DeepSeek V4 Flash 0731 (low) memiliki biaya benchmark lebih rendah di $0.053 vs $0.643. Gemini 2.5 Flash (medium) lebih cepat di 21.18s vs 60.18s, dengan tingkat keberhasilan 75.8% vs 71.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-01

Peringkat
#32
Total token output
314,605
Waktu respons (rata-rata)
60.18s
Total Biaya
$0.053
Peringkat
#31
Total token output
241,203
Waktu respons (rata-rata)
21.18s
Total Biaya
$0.643
Model yang direkomendasikan DeepSeek V4 Flash 0731 (low)

Its score stays close to the best score here (8.2 vs 8.2), while costing about 12.3x less than Gemini 2.5 Flash (medium).

Perbandingan terperinci

Metrik DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 low Rilis: 2026-08-01 Gemini 2.5 Flash Gemini 2.5 Flash medium Rilis: 2025-06-17
Skor 8.2 8.2
Peringkat #32 #31
Keandalan 10.0 10.0
Konsistensi 8.3 9.6
Tes benar
Tingkat lulus per percobaan 75.8% 71.2%
Tes tidak stabil 5 1
Total Run 66 66
Biaya per hasil 0.374 4.286
Total Biaya $0.053 $0.643
Harga input $0.140 / 1M $0.300 / 1M
Harga output $0.280 / 1M $2.500 / 1M
Total token input 93,336 132,498
Token output 40,662 12,739
Token penalaran 273,943 228,464
Waktu respons (rata-rata) 60.18s 21.18s
Waktu respons (maks) 438.65s 140.50s
Waktu respons (total) 1323.92s 465.89s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 DeepSeek V4 Flash 0731

low
SVG tidak valid
Biaya
$0.000
Waktu
78.1s
Token
8,090 tok

#31 Gemini 2.5 Flash

medium
SVG tidak valid
Biaya
$0.000
Waktu
274.0s
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
DeepSeek V4 Flash 0731 7.3 5.1 77.8% 2 163.31s 5,953 782 86,028
Gemini 2.5 Flash 7.8 10.0 66.7% 0 41.01s 6,669 543 32,303

Perbandingan Cepat

Ganti Pasangan Perbandingan