Navigasi
Advertise here

Apodex 1.1 Mini (high) vs Mercury 2 (medium)

Apodex 1.1 Mini (high) unggul dalam skor rata-rata dengan 6.7 vs 6.6. Apodex 1.1 Mini (high) memiliki biaya benchmark lebih rendah di $0.000 vs $0.121. Mercury 2 (medium) lebih cepat di 4.40s vs 31.25s, dengan tingkat keberhasilan 68.1% vs 53.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#195
Total token output
451,532
Waktu respons (rata-rata)
31.25s
Total Biaya
$0.000
Peringkat
#201
Total token output
96,943
Waktu respons (rata-rata)
4.40s
Total Biaya
$0.121
Model yang direkomendasikan Mercury 2 (medium)

Its score stays close to the best score here (6.6 vs 6.7), while responding about 7.1x faster than Apodex 1.1 Mini (high).

Perbandingan terperinci

Metrik Apodex 1.1 Mini Apodex 1.1 Mini high Rilis: 2026-10-02 Tersedia gratis Mercury 2 Mercury 2 medium Rilis: 2026-02-24
Skor 6.7 6.6
Peringkat #195 #201
Keandalan 10.0 10.0
Konsistensi 7.0 8.1
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 68.1% 53.6%
Tes tidak stabil 9 5
Total Run 69 69
Biaya per hasil 0.000 1.201
Total Biaya $0.000 $0.121
Harga input $0.000 / 1M $0.250 / 1M
Harga output $0.000 / 1M $0.750 / 1M
Harga baca cache T/A $0.025 / 1M
Harga tulis cache T/A T/A
Total token input 365,069 189,300
Token output 133,336 10,854
Token penalaran 344,133 86,089
Waktu respons (rata-rata) 31.25s 4.40s
Waktu respons (maks) 114.61s 34.92s
Waktu respons (total) 718.67s 96.81s
Parameter 35B total (~3B aktif) ~100B
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#195 Apodex 1.1 Mini

high
OpenRouter returned no showcase content (finish_reason: length).
Biaya
$0.000
Waktu
290.6s
Token
0 tok

#201 Mercury 2

medium
Biaya
$0.002
Waktu
2.1s
Token
1,702 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Apodex 1.1 Mini 5.5 2.4 66.7% 3 46.96s 7,893 26,748 72,704
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328

Ganti Pasangan Perbandingan