نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Cobuddy vs OpenAI: GPT-5.4 Nano

خلاصہ

Cobuddy vs GPT-5.4 Nano benchmark موازنہ: Cobuddy average score میں آگے ہے: 4.9 vs 4.8. Cobuddy کی benchmark لاگت کم ہے: $0.000 vs $0.011. GPT-5.4 Nano تیز ہے: 1.48s vs 39.90s، pass rates 47.6% vs 30.2%.

تجویز کردہ ماڈل: GPT-5.4 Nano - Its score stays close to the best score here (4.8 vs 4.9), while responding about 27.0x faster than Cobuddy.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Cobuddy Cobuddy medium اجرا: 2026-05-06 GPT-5.4 Nano GPT-5.4 Nano none اجرا: 2026-03-17
اسکور 4.9 4.8
درجہ #144 #149
اعتماد پذیری 10.0 10.0
تسلسل 7.5 8.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 47.6% 30.2%
غیر مستحکم ٹیسٹ 6 5
کل رنز 63 63
فی نتیجہ لاگت 0.000 0.259
کل لاگت $0.000 $0.011
ان پٹ قیمت $0.000 / 1M $0.200 / 1M
آؤٹ پٹ قیمت $0.000 / 1M $1.250 / 1M
کل ان پٹ ٹوکنز 37,449 34,212
آؤٹ پٹ ٹوکنز 1,677 2,784
ریزننگ ٹوکنز 116,703 0
ردِعمل کا وقت (اوسط) 39.90s 1.48s
ردِعمل کا وقت (زیادہ سے زیادہ) 309.02s 4.47s
ردِعمل کا وقت (کل) 797.98s 31.01s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Cobuddy

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#149 GPT-5.4 Nano

none
Cost
$0.008
Time
46.1s
Tokens
5,735 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 606 800 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 11,019 280 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 7,140 219 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 723 52 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 477 180 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
GPT-5.4 Nano 6.3 10.0 50.0% 0 784ms 660 89 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
GPT-5.4 Nano 5.4 10.0 33.3% 0 1.25s 642 308 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 5,445 222 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
GPT-5.4 Nano 3.0 10.0 0.0% 0 773ms 195 21 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں