نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.5-Flash

خلاصہ

GPT-5.4 Mini vs Qwen3.5-Flash benchmark موازنہ: GPT-5.4 Mini average score میں آگے ہے: 8.0 vs 6.8. Qwen3.5-Flash کی benchmark لاگت کم ہے: $0.080 vs $0.526. GPT-5.4 Mini تیز ہے: 22.34s vs 63.29s، pass rates 73.0% vs 71.4%.

تجویز کردہ ماڈل: GPT-5.4 Mini - It has the best score here (8.0), while responding about 2.8x faster than Qwen3.5-Flash.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک GPT-5.4 Mini GPT-5.4 Mini medium اجرا: 2026-03-17 Qwen3.5-Flash Qwen3.5-Flash medium اجرا: 2026-02-24
اسکور 8.0 6.8
درجہ #27 #70
اعتماد پذیری 10.0 10.0
تسلسل 8.0 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 73.0% 71.4%
غیر مستحکم ٹیسٹ 5 5
کل رنز 63 63
فی نتیجہ لاگت 4.381 0.871
کل لاگت $0.526 $0.080
ان پٹ قیمت $0.750 / 1M $0.065 / 1M
آؤٹ پٹ قیمت $4.500 / 1M $0.260 / 1M
کل ان پٹ ٹوکنز 34,116 38,926
آؤٹ پٹ ٹوکنز 2,181 2,088
ریزننگ ٹوکنز 108,937 294,598
ردِعمل کا وقت (اوسط) 22.34s 63.29s
ردِعمل کا وقت (زیادہ سے زیادہ) 138.75s 234.29s
ردِعمل کا وقت (کل) 469.20s 1265.85s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#27 GPT-5.4 Mini

medium
لاگت
$0.056
وقت
95.5s
ٹوکنز
12,464 tok

#70 Qwen3.5-Flash

medium
لاگت
$0.002
وقت
25.8s
ٹوکنز
4,294 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 606 296 2,876
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 672 383 32,992
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.5-Flash 3.7 7.2 22.2% 1 58.87s 6,685 302 90,081
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 11,019 317 4,317
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 14,934 483 8,270
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 7,140 234 650
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 6,061 235 16,237
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 619 60 43,286
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 581 58 43,615
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 477 150 510
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 516 99 38,486
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 9.8 10.0 100.0% 0 2.13s 660 96 1,185
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 699 98 14,139
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.37s 642 278 2,443
Qwen3.5-Flash 8.2 7.2 88.9% 1 27.61s 381 89 12,457
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 5,453 251 2,594
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 8,193 309 1,284
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 195 32 10,174
Qwen3.5-Flash 3.0 10.0 0.0% 0 48.98s 204 32 37,037

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں