Navigasi
AI BENCHY
Advertise here

OpenAI: gpt-oss-120b vs Poolside: Laguna S 2.1

Laguna S 2.1 unggul dalam skor rata-rata dengan 4.5 vs 3.7. gpt-oss-120b memiliki biaya benchmark lebih rendah di $0.010 vs $0.025. Laguna S 2.1 lebih cepat di 11.67s vs 21.61s, dengan tingkat keberhasilan 33.3% vs 15.2%.

Model yang direkomendasikanLaguna S 2.1It has the best score here (4.5), while responding about 1.9x faster than gpt-oss-120b.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-22

Metrik gpt-oss-120b gpt-oss-120b none Rilis: 2025-08-05 Tersedia gratis Laguna S 2.1 Laguna S 2.1 none Rilis: 2026-07-21 Tersedia gratis
Skor 3.7 4.5
Peringkat #216 #200
Keandalan 10.0 10.0
Konsistensi 7.8 8.8
Tes benar
Tingkat lulus per percobaan 33.3% 15.2%
Tes tidak stabil 2 3
Total Run 57 66
Biaya per hasil 0.168 1.205
Total Biaya $0.010 $0.025
Harga input $0.037 / 1M $0.100 / 1M
Harga output $0.170 / 1M $0.200 / 1M
Total token input 9,081 125,598
Token output 51,664 57,634
Token penalaran 0 0
Waktu respons (rata-rata) 21.61s 11.67s
Waktu respons (maks) 113.71s 200.52s
Waktu respons (total) 345.79s 256.80s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#216 gpt-oss-120b

none
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
$0.000
Waktu
-
Token
0 tok

#200 Laguna S 2.1

none
Biaya
$0.001
Waktu
7.6s
Token
1,345 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0

Perbandingan Cepat

Ganti Pasangan Perbandingan