नेविगेशन
AI BENCHY
Advertise here

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

LongCat 2.0 (medium) average score में आगे है: 7.4 vs 7.2. LongCat 2.0 (medium) की benchmark लागत कम है: $0.478 vs $0.482. KAT-Coder-Pro V2.5 (high) तेज है: 20.83s vs 136.64s, pass rates 63.6% vs 60.6%.

अनुशंसित मॉडलKAT-Coder-Pro V2.5 (high)Its score stays close to the best score here (7.2 vs 7.4), while responding about 6.6x faster than LongCat 2.0 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 high रिलीज़: 2026-07-14 LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20
स्कोर 7.2 7.4
रैंक #73 #64
विश्वसनीयता 10.0 9.8
संगति 7.8 8.9
सही परीक्षण
प्रति प्रयास पास दर 63.6% 60.6%
अस्थिर टेस्ट 6 3
कुल रन 66 66
प्रति परिणाम लागत 4.378 3.978
कुल लागत $0.482 $0.478
इनपुट कीमत $0.740 / 1M $0.300 / 1M
आउटपुट कीमत $2.960 / 1M $1.200 / 1M
कुल इनपुट टोकन 106,076 97,315
आउटपुट टोकन 9,071 44,384
रीजनिंग टोकन 127,093 329,012
प्रतिक्रिया समय (औसत) 20.83s 136.64s
प्रतिक्रिया समय (अधिकतम) 199.97s 939.52s
प्रतिक्रिया समय (कुल) 458.31s 3006.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#73 KAT-Coder-Pro V2.5

high
लागत
$0.009
समय
26.4s
टोकन
3,117 tok

#64 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 6.4 7.9 44.4% 1 22.00s 7,893 422 20,461
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143

त्वरित तुलना

तुलना जोड़ी बदलें