Navigasi
Advertise here

Ling 3.0 Tiny (medium) vs gpt-oss-120b

Skor rata-rata hampir imbang di 3.8 vs 3.7. Ling 3.0 Tiny (medium) memiliki biaya benchmark lebih rendah di $0.000 vs $0.033. gpt-oss-120b lebih cepat di 21.61s vs 68.08s, dengan tingkat keberhasilan 24.2% vs 33.3%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-22

Model yang Dibandingkan

Peringkat
#336
Total token output
923,276
Waktu respons (rata-rata)
68.08s
Total Biaya
$0.000
Peringkat
#338
Total token output
51,664
Waktu respons (rata-rata)
21.61s
Total Biaya
$0.033
Model yang direkomendasikan gpt-oss-120b

It has the best score here (3.7), while responding about 3.2x faster than Ling 3.0 Tiny (medium).

Perbandingan terperinci

Metrik Ling 3.0 Tiny Ling 3.0 Tiny medium Rilis: 2026-08-07 gpt-oss-120b gpt-oss-120b none Rilis: 2025-08-05 Tersedia gratis
Skor 3.8 3.7
Peringkat #336 #338
Keandalan 9.6 10.0
Konsistensi 8.9 7.8
Percobaan 66/66 57/66
Tes benar
Tingkat lulus per percobaan 24.2% 33.3%
Tes tidak stabil 3 2
Total Run 66 57
Biaya per hasil 0.000 0.168
Total Biaya $0.000 $0.033
Harga input $0.000 / 1M $0.150 / 1M
Harga output $0.000 / 1M $0.600 / 1M
Total token input 103,898 9,081
Token output 148,304 51,664
Token penalaran 774,972 0
Waktu respons (rata-rata) 68.08s 21.61s
Waktu respons (maks) 262.20s 113.71s
Waktu respons (total) 1429.66s 345.79s
Parameter 7.9B total (1.3B aktif) 117B total (5.1B aktif)
Ketersediaan Sumber terbuka Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#336 Ling 3.0 Tiny

medium
No output was saved. The original provider response or failure reason is unavailable.
Biaya
$0.000
Waktu
177.4s
Token
6,873 tok

#338 gpt-oss-120b

none
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
T/A
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0

Perbandingan Cepat

Ganti Pasangan Perbandingan