नेव्हिगेशन
AI BENCHY
Advertise here

OpenAI: gpt-oss-120b vs Poolside: Laguna S 2.1

Laguna S 2.1 average score मध्ये पुढे आहे: 4.5 vs 3.7. gpt-oss-120b चा benchmark खर्च कमी आहे: $0.010 vs $0.025. Laguna S 2.1 वेगवान आहे: 11.67s vs 21.61s, pass rates 33.3% vs 15.2%.

शिफारस केलेले मॉडेलLaguna S 2.1It has the best score here (4.5), while responding about 1.9x faster than gpt-oss-120b.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक gpt-oss-120b gpt-oss-120b none प्रकाशन: 2025-08-05 मोफत उपलब्ध Laguna S 2.1 Laguna S 2.1 none प्रकाशन: 2026-07-21 मोफत उपलब्ध
स्कोअर 3.7 4.5
क्रमांक #216 #200
विश्वसनीयता 10.0 10.0
सुसंगतता 7.8 8.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 33.3% 15.2%
अस्थिर चाचण्या 2 3
एकूण रन 57 66
प्रति निकाल खर्च 0.168 1.205
एकूण खर्च $0.010 $0.025
इनपुट किंमत $0.037 / 1M $0.100 / 1M
आउटपुट किंमत $0.170 / 1M $0.200 / 1M
एकूण इनपुट टोकन्स 9,081 125,598
आउटपुट टोकन्स 51,664 57,634
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 21.61s 11.67s
प्रतिसाद वेळ (कमाल) 113.71s 200.52s
प्रतिसाद वेळ (एकूण) 345.79s 256.80s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#216 gpt-oss-120b

none
या मॉडेलसाठी अद्याप कोणताही शोकेस निकाल तयार झालेला नाही.
खर्च
$0.000
वेळ
-
टोकन्स
0 tok

#200 Laguna S 2.1

none
खर्च
$0.001
वेळ
7.6s
टोकन्स
1,345 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0

झटपट तुलना

तुलना जोडी बदला