नेव्हिगेशन
AI BENCHY
Advertise here

GPT-4o-mini vs Laguna S 2.1 (low)

Laguna S 2.1 (low) average score मध्ये पुढे आहे: 5.0 vs 5.0. GPT-4o-mini चा benchmark खर्च कमी आहे: $0.010 vs $0.082. GPT-4o-mini वेगवान आहे: 1.92s vs 85.34s, pass rates 22.7% vs 22.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-04

क्रमांक
#268
एकूण आउटपुट टोकन्स
2,913
प्रतिसाद वेळ (सरासरी)
1.92s
एकूण खर्च
$0.010
क्रमांक
#266
एकूण आउटपुट टोकन्स
451,708
प्रतिसाद वेळ (सरासरी)
85.34s
एकूण खर्च
$0.082
शिफारस केलेले मॉडेल GPT-4o-mini

Its score stays close to the best score here (5.0 vs 5.0), while costing about 8.4x less than Laguna S 2.1 (low).

तपशीलवार तुलना

मेट्रिक GPT-4o-mini GPT-4o-mini none प्रकाशन: 2024-07-18 Laguna S 2.1 Laguna S 2.1 low प्रकाशन: 2026-07-21 मोफत उपलब्ध
स्कोअर 5.0 5.0
क्रमांक #268 #266
विश्वसनीयता 10.0 10.0
सुसंगतता 9.9 8.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 22.7% 22.7%
अस्थिर चाचण्या 0 5
एकूण रन 66 66
प्रति निकाल खर्च 0.195 3.022
एकूण खर्च $0.010 $0.082
इनपुट किंमत $0.150 / 1M $0.090 / 1M
आउटपुट किंमत $0.600 / 1M $0.180 / 1M
एकूण इनपुट टोकन्स 53,145 118,752
आउटपुट टोकन्स 2,913 67,823
रिझनिंग टोकन्स 0 383,885
प्रतिसाद वेळ (सरासरी) 1.92s 85.34s
प्रतिसाद वेळ (कमाल) 7.58s 814.73s
प्रतिसाद वेळ (एकूण) 30.71s 1877.49s
पॅरामीटर्स ~8B 118B एकूण (8B सक्रिय)
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#268 GPT-4o-mini

none
खर्च
$0.001
वेळ
6.6s
टोकन्स
742 tok

#266 Laguna S 2.1

low
खर्च
$0.001
वेळ
6.6s
टोकन्स
1,314 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

झटपट तुलना

तुलना जोडी बदला