नेविगेशन
Advertise here

Inkling (high) vs Grok 4.7 (medium)

average score लगभग बराबर है: 8.0 vs 8.1. Inkling (high) की benchmark लागत कम है: $1.046 vs $2.254. Inkling (high) तेज है: 62.57s vs 106.09s, pass rates 77.3% vs 81.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#74
कुल आउटपुट टोकन
236,627
प्रतिक्रिया समय (औसत)
62.57s
कुल लागत
$1.046
रैंक
#73
कुल आउटपुट टोकन
433,733
प्रतिक्रिया समय (औसत)
106.09s
कुल लागत
$2.254
अनुशंसित मॉडल Inkling (high)

It has the best score here (8.0), while costing about 2.2x less than Grok 4.7 (medium).

विस्तृत तुलना

मेट्रिक Inkling Inkling high रिलीज़: 2026-07-18 Grok 4.7 Grok 4.7 medium रिलीज़: 2026-09-21
स्कोर 8.0 8.1
रैंक #74 #73
विश्वसनीयता 10.0 9.9
संगति 8.9 8.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 81.8%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 6.968 15.023
कुल लागत $1.046 $2.254
इनपुट कीमत $1.000 / 1M $1.600 / 1M
आउटपुट कीमत $4.050 / 1M $4.800 / 1M
कुल इनपुट टोकन 86,755 107,193
आउटपुट टोकन 6,057 4,661
रीजनिंग टोकन 230,570 429,072
प्रतिक्रिया समय (औसत) 62.57s 106.09s
प्रतिक्रिया समय (अधिकतम) 327.51s 660.89s
प्रतिक्रिया समय (कुल) 1376.46s 2333.94s
पैरामीटर 975B कुल (41B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Thinking Machines: Inkling

high
लागत
$0.005
समय
32.2s
टोकन
1,275 tok

#73 SpaceXAI: Grok 4.7

medium
लागत
$0.047
समय
132.3s
टोकन
9,954 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Inkling 8.5 10.0 66.7% 0 148.36s 7,374 430 78,982
Grok 4.7 6.6 4.6 77.8% 2 312.17s 10,266 349 172,347

त्वरित तुलना

तुलना जोड़ी बदलें