नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 (low) vs Inkling Small (medium)

LongCat 2.0 (low) average score में आगे है: 6.7 vs 6.6. Inkling Small (medium) की benchmark लागत कम है: $0.117 vs $0.391. Inkling Small (medium) तेज है: 6.27s vs 100.31s, pass rates 53.0% vs 56.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#108
कुल आउटपुट टोकन
303,048
प्रतिक्रिया समय (औसत)
100.31s
कुल लागत
$0.391
रैंक
#112
कुल आउटपुट टोकन
55,321
प्रतिक्रिया समय (औसत)
6.27s
कुल लागत
$0.117
अनुशंसित मॉडल Inkling Small (medium)

Its score stays close to the best score here (6.6 vs 6.7), while costing about 3.4x less than LongCat 2.0 (low).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 low रिलीज़: 2026-07-20 Inkling Small Inkling Small medium रिलीज़: 2026-08-01
स्कोर 6.7 6.6
रैंक #108 #112
विश्वसनीयता 9.6 10.0
संगति 8.9 8.6
सही परीक्षण
प्रति प्रयास पास दर 53.0% 56.1%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 3.910 1.166
कुल लागत $0.391 $0.117
इनपुट कीमत $0.300 / 1M $0.500 / 1M
आउटपुट कीमत $1.200 / 1M $1.200 / 1M
कुल इनपुट टोकन 90,909 100,246
आउटपुट टोकन 5,679 6,422
रीजनिंग टोकन 297,369 48,899
प्रतिक्रिया समय (औसत) 100.31s 6.27s
प्रतिक्रिया समय (अधिकतम) 560.39s 17.26s
प्रतिक्रिया समय (कुल) 2206.82s 138.02s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 LongCat 2.0

low
लागत
$0.024
समय
428.0s
टोकन
19,557 tok

#112 Thinking Machines: Inkling Small

medium
लागत
$0.003
समय
13.4s
टोकन
1,753 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
Inkling Small 7.8 10.0 66.7% 0 10.49s 7,374 434 13,783

त्वरित तुलना

तुलना जोड़ी बदलें