نیویگیشن
Advertise here

Trinity Large Thinking (low) vs Qwen3.6 27B

Qwen3.6 27B average score میں آگے ہے: 6.3 vs 6.3. Qwen3.6 27B کی benchmark لاگت کم ہے: $0.147 vs $0.700. Qwen3.6 27B تیز ہے: 12.71s vs 95.16s، pass rates 47.8% vs 47.8%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#222
کل آؤٹ پٹ ٹوکنز
842,200
ردِعمل کا وقت (اوسط)
95.16s
کل لاگت
$0.700
درجہ
#213
کل آؤٹ پٹ ٹوکنز
20,816
ردِعمل کا وقت (اوسط)
12.71s
کل لاگت
$0.147
تجویز کردہ ماڈل Qwen3.6 27B

It has the best score here (6.3), while costing about 4.8x less than Trinity Large Thinking (low).

تفصیلی موازنہ

میٹرک Trinity Large Thinking Trinity Large Thinking low اجرا: 2026-07-28 Qwen3.6 27B Qwen3.6 27B none اجرا: 2026-04-20
اسکور 6.3 6.3
درجہ #222 #213
اعتماد پذیری 10.0 10.0
تسلسل 8.1 7.7
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 47.8% 47.8%
غیر مستحکم ٹیسٹ 6 6
کل رنز 69 69
فی نتیجہ لاگت 9.163 1.874
کل لاگت $0.700 $0.147
ان پٹ قیمت $0.250 / 1M $0.320 / 1M
آؤٹ پٹ قیمت $0.800 / 1M $3.200 / 1M
کل ان پٹ ٹوکنز 347,980 250,919
آؤٹ پٹ ٹوکنز 121,898 20,816
ریزننگ ٹوکنز 720,302 0
ردِعمل کا وقت (اوسط) 95.16s 12.71s
ردِعمل کا وقت (زیادہ سے زیادہ) 540.96s 156.31s
ردِعمل کا وقت (کل) 2188.74s 292.29s
پیرامیٹرز 398B کل (13B فعال) 27B
دستیابی وزن دستیاب کھلا ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#222 Trinity Large Thinking

low
لاگت
$0.021
وقت
173.2s
ٹوکنز
24,586 tok

#213 Qwen3.6 27B

none
لاگت
$0.009
وقت
83.0s
ٹوکنز
4,549 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں