नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

average score लगभग बराबर है: 6.7 vs 6.7. LongCat 2.0 (low) की benchmark लागत कम है: $0.391 vs $0.476. KAT-Coder-Pro V2.5 तेज है: 25.56s vs 100.31s, pass rates 68.2% vs 53.0%.

अनुशंसित मॉडलKAT-Coder-Pro V2.5It has the best score here (6.7), while responding about 3.9x faster than LongCat 2.0 (low).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-20

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none रिलीज़: 2026-07-14 LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20
स्कोर 6.7 6.7
रैंक #92 #91
विश्वसनीयता 10.0 9.6
संगति 7.4 8.9
सही परीक्षण
प्रति प्रयास पास दर 68.2% 53.0%
अस्थिर टेस्ट 7 3
कुल रन 66 66
प्रति परिणाम लागत 4.319 3.910
कुल लागत $0.476 $0.391
इनपुट कीमत $0.740 / 1M $0.300 / 1M
आउटपुट कीमत $2.960 / 1M $1.200 / 1M
कुल इनपुट टोकन 98,499 90,909
आउटपुट टोकन 135,861 5,679
रीजनिंग टोकन 0 297,369
प्रतिक्रिया समय (औसत) 25.56s 100.31s
प्रतिक्रिया समय (अधिकतम) 335.41s 560.39s
प्रतिक्रिया समय (कुल) 562.43s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 KAT-Coder-Pro V2.5

none
लागत
$0.010
समय
29.0s
टोकन
3,439 tok

#91 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

त्वरित तुलना

तुलना जोड़ी बदलें