نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs Qwen: Qwen3.6 27B

LongCat 2.0 (low) average score میں آگے ہے: 6.7 vs 6.5. LongCat 2.0 (low) کی benchmark لاگت کم ہے: $0.391 vs $0.779. LongCat 2.0 (low) تیز ہے: 100.31s vs 106.32s، pass rates 53.0% vs 59.1%.

تجویز کردہ ماڈلLongCat 2.0 (low)It has the best score here (6.7), while costing about 2.0x less than Qwen3.6 27B (medium).

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-20

میٹرک LongCat 2.0 LongCat 2.0 low اجرا: 2026-07-20 Qwen3.6 27B Qwen3.6 27B medium اجرا: 2026-04-20
اسکور 6.7 6.5
درجہ #91 #99
اعتماد پذیری 9.6 10.0
تسلسل 8.9 8.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 53.0% 59.1%
غیر مستحکم ٹیسٹ 3 6
کل رنز 66 66
فی نتیجہ لاگت 3.910 7.319
کل لاگت $0.391 $0.779
ان پٹ قیمت $0.300 / 1M $0.450 / 1M
آؤٹ پٹ قیمت $1.200 / 1M $2.700 / 1M
کل ان پٹ ٹوکنز 90,909 106,167
آؤٹ پٹ ٹوکنز 5,679 32,889
ریزننگ ٹوکنز 297,369 241,303
ردِعمل کا وقت (اوسط) 100.31s 106.32s
ردِعمل کا وقت (زیادہ سے زیادہ) 560.39s 1085.11s
ردِعمل کا وقت (کل) 2206.82s 2339.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 LongCat 2.0

low
لاگت
$0.024
وقت
428.0s
ٹوکنز
19,557 tok

#99 Qwen3.6 27B

medium
لاگت
$0.009
وقت
39.6s
ٹوکنز
3,090 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں