نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.5 Plus 2026-02-15

خلاصہ

GPT-5.5 vs Qwen3.5 Plus 2026-02-15 benchmark موازنہ: GPT-5.5 average score میں آگے ہے: 6.3 vs 5.8. Qwen3.5 Plus 2026-02-15 کی benchmark لاگت کم ہے: $0.016 vs $0.231. GPT-5.5 تیز ہے: 1.89s vs 2.31s، pass rates 54.0% vs 46.0%.

تجویز کردہ ماڈل: Qwen3.5 Plus 2026-02-15 - Its score stays close to the best score here (5.8 vs 6.3), while costing about 14.6x less than GPT-5.5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک GPT-5.5 GPT-5.5 none اجرا: 2026-04-24 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none اجرا: 2026-02-15
اسکور 6.3 5.8
درجہ #90 #106
اعتماد پذیری 10.0 10.0
تسلسل 8.8 9.4
درست ٹیسٹس
فی کوشش کامیابی کی شرح 54.0% 46.0%
غیر مستحکم ٹیسٹ 3 2
کل رنز 63 63
فی نتیجہ لاگت 2.302 0.204
کل لاگت $0.231 $0.016
ان پٹ قیمت $5.000 / 1M $0.260 / 1M
آؤٹ پٹ قیمت $30.000 / 1M $1.560 / 1M
کل ان پٹ ٹوکنز 34,212 45,864
آؤٹ پٹ ٹوکنز 1,971 2,480
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 1.89s 2.31s
ردِعمل کا وقت (زیادہ سے زیادہ) 5.56s 6.65s
ردِعمل کا وقت (کل) 39.64s 34.63s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 GPT-5.5

none
لاگت
$0.090
وقت
54.3s
ٹوکنز
3,063 tok

#106 Qwen3.5 Plus 2026-02-15

none
لاگت
$0.012
وقت
153.2s
ٹوکنز
7,787 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 6.9 7.9 66.7% 1 1.31s 606 213 0
Qwen3.5 Plus 2026-02-15 4.8 10.0 25.0% 0 1.91s 696 517 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.5 Plus 2026-02-15 4.3 7.9 11.1% 1 2.05s 7,913 473 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 3.0 10.0 0.0% 0 5.56s 11,019 300 0
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 6.65s 18,304 314 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 1.18s 7,140 222 0
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.89s 7,794 243 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 2.9 7.2 11.1% 1 1.31s 723 52 0
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 1.17s 789 17 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 3.41s 477 124 0
Qwen3.5 Plus 2026-02-15 4.4 3.0 33.3% 1 2.26s 522 117 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 6.2 5.8 66.7% 1 1.15s 660 81 0
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.67s 711 72 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 7.7 10.0 66.7% 0 1.29s 642 252 0
Qwen3.5 Plus 2026-02-15 7.7 10.0 66.7% 0 2.71s 714 494 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 10.0 10.0 100.0% 0 3.90s 5,445 247 0
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 3.33s 8,211 222 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 3.0 10.0 0.0% 0 5.01s 195 18 0
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 1.11s 210 11 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں