नेव्हिगेशन
AI BENCHY
Advertise here

OpenAI: GPT-4o-mini vs Poolside: Laguna S 2.1

Laguna S 2.1 (low) average score मध्ये पुढे आहे: 5.0 vs 5.0. GPT-4o-mini चा benchmark खर्च कमी आहे: $0.010 vs $0.091. GPT-4o-mini वेगवान आहे: 1.99s vs 85.35s, pass rates 22.7% vs 25.8%.

शिफारस केलेले मॉडेलGPT-4o-miniIts score stays close to the best score here (5.0 vs 5.0), while costing about 9.3x less than Laguna S 2.1 (low).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक GPT-4o-mini GPT-4o-mini none प्रकाशन: 2024-07-18 Laguna S 2.1 Laguna S 2.1 low प्रकाशन: 2026-07-21 मोफत उपलब्ध
स्कोअर 5.0 5.0
क्रमांक #183 #181
विश्वसनीयता 10.0 9.9
सुसंगतता 9.9 7.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 22.7% 25.8%
अस्थिर चाचण्या 0 6
एकूण रन 66 66
प्रति निकाल खर्च 0.195 3.022
एकूण खर्च $0.010 $0.091
इनपुट किंमत $0.150 / 1M $0.100 / 1M
आउटपुट किंमत $0.600 / 1M $0.200 / 1M
एकूण इनपुट टोकन्स 53,136 118,746
आउटपुट टोकन्स 2,911 67,823
रिझनिंग टोकन्स 0 383,885
प्रतिसाद वेळ (सरासरी) 1.99s 85.35s
प्रतिसाद वेळ (कमाल) 7.58s 814.73s
प्रतिसाद वेळ (एकूण) 29.86s 1877.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#183 GPT-4o-mini

none
खर्च
$0.001
वेळ
6.6s
टोकन्स
742 tok

#181 Laguna S 2.1

low
खर्च
$0.001
वेळ
6.6s
टोकन्स
1,314 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

झटपट तुलना

तुलना जोडी बदला