نیویگیشن
AI BENCHY
Advertise here

GPT-5.5 vs Qwen3.7 Flash (medium)

Qwen3.7 Flash (medium) average score میں آگے ہے: 7.0 vs 6.9. Qwen3.7 Flash (medium) کی benchmark لاگت کم ہے: $0.064 vs $0.544. GPT-5.5 تیز ہے: 2.36s vs 45.90s، pass rates 56.1% vs 65.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-28

درجہ
#98
کل آؤٹ پٹ ٹوکنز
4,915
ردِعمل کا وقت (اوسط)
2.36s
کل لاگت
$0.544
درجہ
#91
کل آؤٹ پٹ ٹوکنز
462,623
ردِعمل کا وقت (اوسط)
45.90s
کل لاگت
$0.064
تجویز کردہ ماڈل Qwen3.7 Flash (medium)

It has the best score here (7.0), while costing about 8.6x less than GPT-5.5.

تفصیلی موازنہ

میٹرک GPT-5.5 GPT-5.5 none اجرا: 2026-04-24 Qwen3.7 Flash Qwen3.7 Flash medium اجرا: 2026-07-28
اسکور 6.9 7.0
درجہ #98 #91
اعتماد پذیری 10.0 10.0
تسلسل 8.9 7.5
درست ٹیسٹس
فی کوشش کامیابی کی شرح 56.1% 65.2%
غیر مستحکم ٹیسٹ 3 7
کل رنز 66 66
فی نتیجہ لاگت 4.945 0.636
کل لاگت $0.544 $0.064
ان پٹ قیمت $5.000 / 1M $0.030 / 1M
آؤٹ پٹ قیمت $30.000 / 1M $0.130 / 1M
کل ان پٹ ٹوکنز 79,285 114,468
آؤٹ پٹ ٹوکنز 4,915 12,786
ریزننگ ٹوکنز 0 449,837
ردِعمل کا وقت (اوسط) 2.36s 45.90s
ردِعمل کا وقت (زیادہ سے زیادہ) 12.24s 593.64s
ردِعمل کا وقت (کل) 51.88s 1009.84s

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 GPT-5.5

none
لاگت
$0.090
وقت
54.3s
ٹوکنز
3,063 tok

#91 Qwen3.7 Flash

medium
غلط SVG
لاگت
$0.000
وقت
600.0s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.7 Flash 6.2 6.9 55.6% 1 46.78s 7,893 563 61,902

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں