नेविगेशन
AI BENCHY
Advertise here

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

average score लगभग बराबर है: 7.4 vs 7.4. KAT-Coder-Pro V2.5 (low) की benchmark लागत कम है: $0.387 vs $0.478. KAT-Coder-Pro V2.5 (low) तेज है: 19.47s vs 136.64s, pass rates 69.7% vs 60.6%.

अनुशंसित मॉडलKAT-Coder-Pro V2.5 (low)It has the best score here (7.4), while responding about 7.0x faster than LongCat 2.0 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-20

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low रिलीज़: 2026-07-14 LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20
स्कोर 7.4 7.4
रैंक #62 #60
विश्वसनीयता 10.0 9.8
संगति 7.0 8.9
सही परीक्षण
प्रति प्रयास पास दर 69.7% 60.6%
अस्थिर टेस्ट 8 3
कुल रन 66 66
प्रति परिणाम लागत 3.514 3.978
कुल लागत $0.387 $0.478
इनपुट कीमत $0.740 / 1M $0.300 / 1M
आउटपुट कीमत $2.960 / 1M $1.200 / 1M
कुल इनपुट टोकन 87,673 97,315
आउटपुट टोकन 7,166 44,384
रीजनिंग टोकन 101,474 329,012
प्रतिक्रिया समय (औसत) 19.47s 136.64s
प्रतिक्रिया समय (अधिकतम) 209.15s 939.52s
प्रतिक्रिया समय (कुल) 428.31s 3006.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 KAT-Coder-Pro V2.5

low
लागत
$0.016
समय
47.6s
टोकन
5,182 tok

#60 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143

त्वरित तुलना

तुलना जोड़ी बदलें