नेविगेशन
Advertise here

GPT-4o-mini vs Laguna S 2.1 (high)

GPT-4o-mini average score में आगे है: 5.0 vs 4.9. GPT-4o-mini की benchmark लागत कम है: $0.024 vs $0.147. GPT-4o-mini तेज है: 4.16s vs 113.63s, pass rates 21.7% vs 27.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#300
कुल आउटपुट टोकन
3,627
प्रतिक्रिया समय (औसत)
4.16s
कुल लागत
$0.024
रैंक
#305
कुल आउटपुट टोकन
630,543
प्रतिक्रिया समय (औसत)
113.63s
कुल लागत
$0.147
अनुशंसित मॉडल GPT-4o-mini

It has the best score here (5.0), while costing about 6.1x less than Laguna S 2.1 (high).

विस्तृत तुलना

मेट्रिक GPT-4o-mini GPT-4o-mini none रिलीज़: 2024-07-18 Laguna S 2.1 Laguna S 2.1 high रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.0 4.9
रैंक #300 #305
विश्वसनीयता 10.0 10.0
संगति 9.9 7.8
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 21.7% 27.5%
अस्थिर टेस्ट 0 6
कुल रन 69 69
प्रति परिणाम लागत 0.480 3.664
कुल लागत $0.024 $0.147
इनपुट कीमत $0.150 / 1M $0.090 / 1M
आउटपुट कीमत $0.600 / 1M $0.180 / 1M
कुल इनपुट टोकन 145,180 344,806
आउटपुट टोकन 3,627 177,330
रीजनिंग टोकन 0 453,213
प्रतिक्रिया समय (औसत) 4.16s 113.63s
प्रतिक्रिया समय (अधिकतम) 39.99s 1190.11s
प्रतिक्रिया समय (कुल) 70.70s 2613.48s
पैरामीटर ~8B 118B कुल (8B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#300 GPT-4o-mini

none
लागत
$0.001
समय
6.6s
टोकन
742 tok

#305 Laguna S 2.1

high
लागत
$0.001
समय
6.8s
टोकन
1,389 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009

त्वरित तुलना

तुलना जोड़ी बदलें