Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ling 3.0 Tiny (medium) vs gpt-oss-120b

Skor rata-rata hampir imbang di 3.8 vs 3.7. Ling 3.0 Tiny (medium) memiliki biaya benchmark lebih rendah di $0.000 vs $0.010. gpt-oss-120b lebih cepat di 21.61s vs 68.74s, dengan tingkat keberhasilan 24.2% vs 33.3%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-07

Peringkat
#244
Total token output
1,021,580
Waktu respons (rata-rata)
68.74s
Total Biaya
$0.000
Peringkat
#246
Total token output
51,664
Waktu respons (rata-rata)
21.61s
Total Biaya
$0.010
Model yang direkomendasikan gpt-oss-120b

It has the best score here (3.7), while responding about 3.2x faster than Ling 3.0 Tiny (medium).

Perbandingan terperinci

Metrik Ling 3.0 Tiny Ling 3.0 Tiny medium Rilis: 2026-08-07 Tersedia gratis gpt-oss-120b gpt-oss-120b none Rilis: 2025-08-05 Tersedia gratis
Skor 3.8 3.7
Peringkat #244 #246
Keandalan 9.7 10.0
Konsistensi 8.9 7.8
Cakupan benchmark 22/22 tes · 66/66 percobaan 19/22 tes · 57/66 percobaan
Tes benar
Tingkat lulus per percobaan 24.2% 33.3%
Tes tidak stabil 3 2
Total Run 66 57
Biaya per hasil 0.000 0.168
Total Biaya $0.000 $0.010
Harga input $0.000 / 1M $0.037 / 1M
Harga output $0.000 / 1M $0.170 / 1M
Total token input 104,078 9,081
Token output 153,908 51,664
Token penalaran 867,672 0
Waktu respons (rata-rata) 68.74s 21.61s
Waktu respons (maks) 262.20s 113.71s
Waktu respons (total) 1512.22s 345.79s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#244 Ling 3.0 Tiny

medium
SVG tidak valid
Biaya
$0.000
Waktu
177.4s
Token
6,873 tok

#246 gpt-oss-120b

none
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
$0.000
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0

Perbandingan Cepat

Ganti Pasangan Perbandingan