نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-4o-mini vs Poolside: Laguna S 2.1

Laguna S 2.1 (low) average score میں آگے ہے: 5.0 vs 5.0. GPT-4o-mini کی benchmark لاگت کم ہے: $0.010 vs $0.091. GPT-4o-mini تیز ہے: 1.99s vs 85.35s، pass rates 22.7% vs 25.8%.

تجویز کردہ ماڈلGPT-4o-miniIts score stays close to the best score here (5.0 vs 5.0), while costing about 9.3x less than Laguna S 2.1 (low).

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-22

میٹرک GPT-4o-mini GPT-4o-mini none اجرا: 2024-07-18 Laguna S 2.1 Laguna S 2.1 low اجرا: 2026-07-21 مفت دستیاب
اسکور 5.0 5.0
درجہ #183 #181
اعتماد پذیری 10.0 9.9
تسلسل 9.9 7.8
درست ٹیسٹس
فی کوشش کامیابی کی شرح 22.7% 25.8%
غیر مستحکم ٹیسٹ 0 6
کل رنز 66 66
فی نتیجہ لاگت 0.195 3.022
کل لاگت $0.010 $0.091
ان پٹ قیمت $0.150 / 1M $0.100 / 1M
آؤٹ پٹ قیمت $0.600 / 1M $0.200 / 1M
کل ان پٹ ٹوکنز 53,136 118,746
آؤٹ پٹ ٹوکنز 2,911 67,823
ریزننگ ٹوکنز 0 383,885
ردِعمل کا وقت (اوسط) 1.99s 85.35s
ردِعمل کا وقت (زیادہ سے زیادہ) 7.58s 814.73s
ردِعمل کا وقت (کل) 29.86s 1877.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#183 GPT-4o-mini

none
لاگت
$0.001
وقت
6.6s
ٹوکنز
742 tok

#181 Laguna S 2.1

low
لاگت
$0.001
وقت
6.6s
ٹوکنز
1,314 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں