नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs Qwen: Qwen3.7 Max

average score जवळपास समान आहे: 7.4 vs 7.4. Qwen3.7 Max चा benchmark खर्च कमी आहे: $0.197 vs $0.478. Qwen3.7 Max वेगवान आहे: 4.52s vs 136.64s, pass rates 60.6% vs 68.2%.

शिफारस केलेले मॉडेलQwen3.7 MaxIt has the best score here (7.4), while costing about 2.4x less than LongCat 2.0 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-20

मेट्रिक LongCat 2.0 LongCat 2.0 medium प्रकाशन: 2026-07-20 Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22
स्कोअर 7.4 7.4
क्रमांक #60 #59
विश्वसनीयता 9.8 9.9
सुसंगतता 8.9 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 60.6% 68.2%
अस्थिर चाचण्या 3 0
एकूण रन 66 66
प्रति निकाल खर्च 3.978 1.582
एकूण खर्च $0.478 $0.197
इनपुट किंमत $0.300 / 1M $1.475 / 1M
आउटपुट किंमत $1.200 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 97,315 95,983
आउटपुट टोकन्स 44,384 12,446
रिझनिंग टोकन्स 329,012 0
प्रतिसाद वेळ (सरासरी) 136.64s 4.52s
प्रतिसाद वेळ (कमाल) 939.52s 72.30s
प्रतिसाद वेळ (एकूण) 3006.01s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 LongCat 2.0

medium
खर्च
$0.016
वेळ
285.1s
टोकन्स
13,057 tok

#59 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

झटपट तुलना

तुलना जोडी बदला