نیویگیشن
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.6 27B

LongCat 2.0 (high) average score میں آگے ہے: 6.6 vs 6.5. LongCat 2.0 (high) کی benchmark لاگت کم ہے: $0.469 vs $0.779. Qwen3.6 27B (medium) تیز ہے: 106.32s vs 148.73s، pass rates 53.0% vs 59.1%.

تجویز کردہ ماڈلLongCat 2.0 (high)It has the best score here (6.6), while costing about 1.7x less than Qwen3.6 27B (medium).

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-20

میٹرک LongCat 2.0 LongCat 2.0 high اجرا: 2026-07-20 Qwen3.6 27B Qwen3.6 27B medium اجرا: 2026-04-20
اسکور 6.6 6.5
درجہ #97 #99
اعتماد پذیری 9.4 10.0
تسلسل 8.2 8.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 53.0% 59.1%
غیر مستحکم ٹیسٹ 5 6
کل رنز 66 66
فی نتیجہ لاگت 5.202 7.319
کل لاگت $0.469 $0.779
ان پٹ قیمت $0.300 / 1M $0.450 / 1M
آؤٹ پٹ قیمت $1.200 / 1M $2.700 / 1M
کل ان پٹ ٹوکنز 93,357 106,167
آؤٹ پٹ ٹوکنز 30,466 32,889
ریزننگ ٹوکنز 336,325 241,303
ردِعمل کا وقت (اوسط) 148.73s 106.32s
ردِعمل کا وقت (زیادہ سے زیادہ) 941.66s 1085.11s
ردِعمل کا وقت (کل) 3272.00s 2339.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
غلط SVG
لاگت
$0.000
وقت
600.0s
ٹوکنز
0 tok

#99 Qwen3.6 27B

medium
لاگت
$0.009
وقت
39.6s
ٹوکنز
3,090 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں