نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs Qwen: Qwen3.7 Max

خلاصہ

GPT-5.4 Nano vs Qwen3.7 Max benchmark موازنہ: GPT-5.4 Nano average score میں آگے ہے: 7.5 vs 6.9. Qwen3.7 Max کی benchmark لاگت کم ہے: $0.054 vs $0.107. Qwen3.7 Max تیز ہے: 1.30s vs 11.95s، pass rates 63.5% vs 66.7%.

تجویز کردہ ماڈل: Qwen3.7 Max - Its score stays close to the best score here (6.9 vs 7.5), while costing about 2.0x less than GPT-5.4 Nano.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک GPT-5.4 Nano GPT-5.4 Nano medium اجرا: 2026-03-17 Qwen3.7 Max Qwen3.7 Max none اجرا: 2026-05-22
اسکور 7.5 6.9
درجہ #48 #69
اعتماد پذیری 10.0 10.0
تسلسل 8.4 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 63.5% 66.7%
غیر مستحکم ٹیسٹ 4 0
کل رنز 63 63
فی نتیجہ لاگت 0.969 0.744
کل لاگت $0.107 $0.054
ان پٹ قیمت $0.200 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $1.250 / 1M $3.750 / 1M
کل ان پٹ ٹوکنز 35,434 37,107
آؤٹ پٹ ٹوکنز 3,014 1,994
ریزننگ ٹوکنز 76,520 0
ردِعمل کا وقت (اوسط) 11.95s 1.30s
ردِعمل کا وقت (زیادہ سے زیادہ) 94.06s 3.92s
ردِعمل کا وقت (کل) 250.98s 27.21s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

#69 Qwen3.7 Max

none
Cost
$0.046
Time
195.0s
Tokens
12,171 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
Qwen3.7 Max 6.5 10.0 50.0% 0 1.08s 696 242 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
Qwen3.7 Max 3.0 10.0 0.0% 0 2.17s 9,549 171 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
Qwen3.7 Max 10.0 10.0 100.0% 0 1.35s 7,794 243 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
Qwen3.7 Max 7.7 10.0 66.7% 0 975ms 789 15 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
Qwen3.7 Max 10.0 10.0 100.0% 0 1.04s 522 120 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
Qwen3.7 Max 10.0 10.0 100.0% 0 943ms 711 72 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
Qwen3.7 Max 10.0 10.0 100.0% 0 1.13s 714 314 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
Qwen3.7 Max 10.0 10.0 100.0% 0 3.92s 8,211 222 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174
Qwen3.7 Max 3.0 10.0 0.0% 0 856ms 210 13 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں