Navigasi
AI BENCHY
Advertise here

Ling 3.0 Tiny (high) vs MiniMax M2.5 (medium)

MiniMax M2.5 (medium) unggul dalam skor rata-rata dengan 4.6 vs 3.8. Ling 3.0 Tiny (high) memiliki biaya benchmark lebih rendah di $0.000 vs $0.350. MiniMax M2.5 (medium) lebih cepat di 68.27s vs 76.06s, dengan tingkat keberhasilan 24.2% vs 45.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-07

Peringkat
#240
Total token output
1,048,987
Waktu respons (rata-rata)
76.06s
Total Biaya
$0.000
Peringkat
#225
Total token output
465,377
Waktu respons (rata-rata)
68.27s
Total Biaya
$0.350
Model yang direkomendasikan MiniMax M2.5 (medium)

It has the strongest score in this comparison (4.6) and the best overall balance of cost and response time across all 2 models.

Perbandingan terperinci

Metrik Ling 3.0 Tiny Ling 3.0 Tiny high Rilis: 2026-08-07 Tersedia gratis MiniMax M2.5 MiniMax M2.5 medium Rilis: 2026-02-12
Skor 3.8 4.6
Peringkat #240 #225
Keandalan 10.0 10.0
Konsistensi 8.8 6.2
Cakupan benchmark 22/22 tes · 66/66 percobaan 22/22 tes · 66/66 percobaan
Tes benar
Tingkat lulus per percobaan 24.2% 45.5%
Tes tidak stabil 3 10
Total Run 66 66
Biaya per hasil 0.000 8.648
Total Biaya $0.000 $0.350
Harga input $0.000 / 1M $0.220 / 1M
Harga output $0.000 / 1M $0.900 / 1M
Total token input 115,494 142,561
Token output 139,569 125,442
Token penalaran 909,418 339,935
Waktu respons (rata-rata) 76.06s 68.27s
Waktu respons (maks) 345.15s 251.36s
Waktu respons (total) 1673.38s 955.75s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#240 Ling 3.0 Tiny

high
SVG tidak valid
Biaya
$0.000
Waktu
169.5s
Token
5,252 tok

#225 MiniMax M2.5

medium
SVG tidak valid
Biaya
$0.000
Waktu
300.0s
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177

Perbandingan Cepat

Ganti Pasangan Perbandingan