नेव्हिगेशन
AI BENCHY
Advertise here

LongCat 2.0 (medium) vs Grok 4.6 (low)

average score जवळपास समान आहे: 7.4 vs 7.4. Grok 4.6 (low) चा benchmark खर्च कमी आहे: $0.441 vs $0.478. Grok 4.6 (low) वेगवान आहे: 14.20s vs 136.64s, pass rates 60.6% vs 71.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-12

क्रमांक
#88
एकूण आउटपुट टोकन्स
373,396
प्रतिसाद वेळ (सरासरी)
136.64s
एकूण खर्च
$0.478
क्रमांक
#90
एकूण आउटपुट टोकन्स
36,792
प्रतिसाद वेळ (सरासरी)
14.20s
एकूण खर्च
$0.441
शिफारस केलेले मॉडेल Grok 4.6 (low)

It has the best score here (7.4), while responding about 9.6x faster than LongCat 2.0 (medium).

तपशीलवार तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 medium प्रकाशन: 2026-07-20 Grok 4.6 Grok 4.6 low प्रकाशन: 2026-08-12
स्कोअर 7.4 7.4
क्रमांक #88 #90
विश्वसनीयता 9.8 10.0
सुसंगतता 8.9 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 60.6% 71.2%
अस्थिर चाचण्या 3 2
एकूण रन 66 66
प्रति निकाल खर्च 3.978 2.938
एकूण खर्च $0.478 $0.441
इनपुट किंमत $0.300 / 1M $2.000 / 1M
आउटपुट किंमत $1.200 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 97,315 109,951
आउटपुट टोकन्स 44,384 5,124
रिझनिंग टोकन्स 329,012 31,668
प्रतिसाद वेळ (सरासरी) 136.64s 14.20s
प्रतिसाद वेळ (कमाल) 939.52s 26.46s
प्रतिसाद वेळ (एकूण) 3006.01s 312.33s
पॅरामीटर्स 1.6T एकूण (48B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#88 LongCat 2.0

medium
खर्च
$0.016
वेळ
285.1s
टोकन्स
13,057 tok

#90 SpaceXAI: Grok 4.6

low
खर्च
$0.011
वेळ
26.0s
टोकन्स
1,941 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

झटपट तुलना

तुलना जोडी बदला