नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.4 Nano vs Poolside: Laguna S 2.1

Laguna S 2.1 (low) average score में आगे है: 5.0 vs 4.8. GPT-5.4 Nano की benchmark लागत कम है: $0.041 vs $0.091. GPT-5.4 Nano तेज है: 2.57s vs 85.35s, pass rates 28.8% vs 25.8%.

अनुशंसित मॉडलGPT-5.4 NanoIts score stays close to the best score here (4.8 vs 5.0), while costing about 2.2x less than Laguna S 2.1 (low).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano none रिलीज़: 2026-03-17 Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 4.8 5.0
रैंक #189 #181
विश्वसनीयता 10.0 9.9
संगति 8.2 7.8
सही परीक्षण
प्रति प्रयास पास दर 28.8% 25.8%
अस्थिर टेस्ट 5 6
कुल रन 66 66
प्रति परिणाम लागत 1.011 3.022
कुल लागत $0.041 $0.091
इनपुट कीमत $0.200 / 1M $0.100 / 1M
आउटपुट कीमत $1.250 / 1M $0.200 / 1M
कुल इनपुट टोकन 115,924 118,746
आउटपुट टोकन 13,794 67,823
रीजनिंग टोकन 0 383,885
प्रतिक्रिया समय (औसत) 2.57s 85.35s
प्रतिक्रिया समय (अधिकतम) 25.50s 814.73s
प्रतिक्रिया समय (कुल) 56.51s 1877.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#189 GPT-5.4 Nano

none
लागत
$0.008
समय
46.1s
टोकन
5,735 tok

#181 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

त्वरित तुलना

तुलना जोड़ी बदलें