नेव्हिगेशन
AI BENCHY
Advertise here

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

average score जवळपास समान आहे: 7.4 vs 7.4. KAT-Coder-Pro V2.5 (low) चा benchmark खर्च कमी आहे: $0.387 vs $0.478. KAT-Coder-Pro V2.5 (low) वेगवान आहे: 19.47s vs 136.64s, pass rates 69.7% vs 60.6%.

शिफारस केलेले मॉडेलKAT-Coder-Pro V2.5 (low)It has the best score here (7.4), while responding about 7.0x faster than LongCat 2.0 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-20

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low प्रकाशन: 2026-07-14 LongCat 2.0 LongCat 2.0 medium प्रकाशन: 2026-07-20
स्कोअर 7.4 7.4
क्रमांक #62 #60
विश्वसनीयता 10.0 9.8
सुसंगतता 7.0 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 60.6%
अस्थिर चाचण्या 8 3
एकूण रन 66 66
प्रति निकाल खर्च 3.514 3.978
एकूण खर्च $0.387 $0.478
इनपुट किंमत $0.740 / 1M $0.300 / 1M
आउटपुट किंमत $2.960 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 87,673 97,315
आउटपुट टोकन्स 7,166 44,384
रिझनिंग टोकन्स 101,474 329,012
प्रतिसाद वेळ (सरासरी) 19.47s 136.64s
प्रतिसाद वेळ (कमाल) 209.15s 939.52s
प्रतिसाद वेळ (एकूण) 428.31s 3006.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 KAT-Coder-Pro V2.5

low
खर्च
$0.016
वेळ
47.6s
टोकन्स
5,182 tok

#60 LongCat 2.0

medium
खर्च
$0.016
वेळ
285.1s
टोकन्स
13,057 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143

झटपट तुलना

तुलना जोडी बदला