नेविगेशन
Advertise here

Inkling Small (high) vs Grok 4.5 (low)

average score लगभग बराबर है: 8.4 vs 8.4. Inkling Small (high) की benchmark लागत कम है: $0.398 vs $0.945. Grok 4.5 (low) तेज है: 16.17s vs 30.43s, pass rates 69.7% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#61
कुल आउटपुट टोकन
298,893
प्रतिक्रिया समय (औसत)
30.43s
कुल लागत
$0.398
रैंक
#57
कुल आउटपुट टोकन
115,489
प्रतिक्रिया समय (औसत)
16.17s
कुल लागत
$0.945
अनुशंसित मॉडल Inkling Small (high)

It has the best score here (8.4), while costing about 2.4x less than Grok 4.5 (low).

विस्तृत तुलना

मेट्रिक Inkling Small Inkling Small high रिलीज़: 2026-08-01 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 8.4 8.4
रैंक #61 #57
विश्वसनीयता 10.0 10.0
संगति 9.2 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 77.3%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 2.868 5.901
कुल लागत $0.398 $0.945
इनपुट कीमत $0.450 / 1M $2.000 / 1M
आउटपुट कीमत $1.200 / 1M $6.000 / 1M
कुल इनपुट टोकन 85,669 125,605
आउटपुट टोकन 6,092 7,505
रीजनिंग टोकन 292,801 107,984
प्रतिक्रिया समय (औसत) 30.43s 16.17s
प्रतिक्रिया समय (अधिकतम) 122.60s 205.28s
प्रतिक्रिया समय (कुल) 669.38s 355.67s
पैरामीटर 276B कुल (12B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Thinking Machines: Inkling Small

high
लागत
$0.006
समय
34.7s
टोकन
4,735 tok

#57 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Inkling Small 10.0 10.0 100.0% 0 93.23s 7,374 463 120,474
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें