नेव्हिगेशन
AI BENCHY
Advertise here

LongCat 2.0 (low) vs Inkling Small (medium)

LongCat 2.0 (low) average score मध्ये पुढे आहे: 6.7 vs 6.6. Inkling Small (medium) चा benchmark खर्च कमी आहे: $0.117 vs $0.391. Inkling Small (medium) वेगवान आहे: 6.27s vs 100.31s, pass rates 53.0% vs 56.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#108
एकूण आउटपुट टोकन्स
303,048
प्रतिसाद वेळ (सरासरी)
100.31s
एकूण खर्च
$0.391
क्रमांक
#112
एकूण आउटपुट टोकन्स
55,321
प्रतिसाद वेळ (सरासरी)
6.27s
एकूण खर्च
$0.117
शिफारस केलेले मॉडेल Inkling Small (medium)

Its score stays close to the best score here (6.6 vs 6.7), while costing about 3.4x less than LongCat 2.0 (low).

तपशीलवार तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 low प्रकाशन: 2026-07-20 Inkling Small Inkling Small medium प्रकाशन: 2026-08-01
स्कोअर 6.7 6.6
क्रमांक #108 #112
विश्वसनीयता 9.6 10.0
सुसंगतता 8.9 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 56.1%
अस्थिर चाचण्या 3 4
एकूण रन 66 66
प्रति निकाल खर्च 3.910 1.166
एकूण खर्च $0.391 $0.117
इनपुट किंमत $0.300 / 1M $0.500 / 1M
आउटपुट किंमत $1.200 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 90,909 100,246
आउटपुट टोकन्स 5,679 6,422
रिझनिंग टोकन्स 297,369 48,899
प्रतिसाद वेळ (सरासरी) 100.31s 6.27s
प्रतिसाद वेळ (कमाल) 560.39s 17.26s
प्रतिसाद वेळ (एकूण) 2206.82s 138.02s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 LongCat 2.0

low
खर्च
$0.024
वेळ
428.0s
टोकन्स
19,557 tok

#112 Thinking Machines: Inkling Small

medium
खर्च
$0.003
वेळ
13.4s
टोकन्स
1,753 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
Inkling Small 7.8 10.0 66.7% 0 10.49s 7,374 434 13,783

झटपट तुलना

तुलना जोडी बदला