नेविगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.7 Max

average score लगभग बराबर है: 7.4 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.478. Qwen3.7 Max तेज है: 4.52s vs 136.64s, pass rates 60.6% vs 68.2%.

अनुशंसित मॉडलQwen3.7 MaxIt has the best score here (7.4), while costing about 2.4x less than LongCat 2.0 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-20

मेट्रिक LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 7.4 7.4
रैंक #60 #59
विश्वसनीयता 9.8 9.9
संगति 8.9 10.0
सही परीक्षण
प्रति प्रयास पास दर 60.6% 68.2%
अस्थिर टेस्ट 3 0
कुल रन 66 66
प्रति परिणाम लागत 3.978 1.582
कुल लागत $0.478 $0.197
इनपुट कीमत $0.300 / 1M $1.475 / 1M
आउटपुट कीमत $1.200 / 1M $4.425 / 1M
कुल इनपुट टोकन 97,315 95,983
आउटपुट टोकन 44,384 12,446
रीजनिंग टोकन 329,012 0
प्रतिक्रिया समय (औसत) 136.64s 4.52s
प्रतिक्रिया समय (अधिकतम) 939.52s 72.30s
प्रतिक्रिया समय (कुल) 3006.01s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

#59 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें