नेविगेशन
AI BENCHY
Advertise here

GPT-4o-mini vs Laguna S 2.1 (low)

Laguna S 2.1 (low) average score में आगे है: 5.0 vs 5.0. GPT-4o-mini की benchmark लागत कम है: $0.010 vs $0.082. GPT-4o-mini तेज है: 1.92s vs 85.34s, pass rates 22.7% vs 22.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#268
कुल आउटपुट टोकन
2,913
प्रतिक्रिया समय (औसत)
1.92s
कुल लागत
$0.010
रैंक
#266
कुल आउटपुट टोकन
451,708
प्रतिक्रिया समय (औसत)
85.34s
कुल लागत
$0.082
अनुशंसित मॉडल GPT-4o-mini

Its score stays close to the best score here (5.0 vs 5.0), while costing about 8.4x less than Laguna S 2.1 (low).

विस्तृत तुलना

मेट्रिक GPT-4o-mini GPT-4o-mini none रिलीज़: 2024-07-18 Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.0 5.0
रैंक #268 #266
विश्वसनीयता 10.0 10.0
संगति 9.9 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 22.7% 22.7%
अस्थिर टेस्ट 0 5
कुल रन 66 66
प्रति परिणाम लागत 0.195 3.022
कुल लागत $0.010 $0.082
इनपुट कीमत $0.150 / 1M $0.090 / 1M
आउटपुट कीमत $0.600 / 1M $0.180 / 1M
कुल इनपुट टोकन 53,145 118,752
आउटपुट टोकन 2,913 67,823
रीजनिंग टोकन 0 383,885
प्रतिक्रिया समय (औसत) 1.92s 85.34s
प्रतिक्रिया समय (अधिकतम) 7.58s 814.73s
प्रतिक्रिया समय (कुल) 30.71s 1877.49s
पैरामीटर ~8B 118B कुल (8B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#268 GPT-4o-mini

none
लागत
$0.001
समय
6.6s
टोकन
742 tok

#266 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

त्वरित तुलना

तुलना जोड़ी बदलें