नेविगेशन
Advertise here

GPT-6 Luna (high) vs Inkling Small (high)

Inkling Small (high) average score में आगे है: 8.4 vs 8.3. GPT-6 Luna (high) की benchmark लागत कम है: $0.054 vs $0.398. GPT-6 Luna (high) तेज है: 17.53s vs 30.43s, pass rates 75.8% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#73
कुल आउटपुट टोकन
91,405
प्रतिक्रिया समय (औसत)
17.53s
कुल लागत
$0.054
रैंक
#69
कुल आउटपुट टोकन
298,893
प्रतिक्रिया समय (औसत)
30.43s
कुल लागत
$0.398
अनुशंसित मॉडल GPT-6 Luna (high)

Its score stays close to the best score here (8.3 vs 8.4), while costing about 7.4x less than Inkling Small (high).

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23 Inkling Small Inkling Small high रिलीज़: 2026-08-01
स्कोर 8.3 8.4
रैंक #73 #69
विश्वसनीयता 10.0 10.0
संगति 9.0 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 75.8% 69.7%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 0.359 2.868
कुल लागत $0.054 $0.398
इनपुट कीमत $0.100 / 1M $0.450 / 1M
आउटपुट कीमत $0.500 / 1M $1.200 / 1M
कुल इनपुट टोकन 80,441 85,669
आउटपुट टोकन 4,761 6,092
रीजनिंग टोकन 86,644 292,801
प्रतिक्रिया समय (औसत) 17.53s 30.43s
प्रतिक्रिया समय (अधिकतम) 106.93s 122.60s
प्रतिक्रिया समय (कुल) 385.74s 669.38s
पैरामीटर ~400B कुल (~17B सक्रिय) 276B कुल (12B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#73 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

#69 Thinking Machines: Inkling Small

high
लागत
$0.006
समय
34.7s
टोकन
4,735 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Inkling Small 10.0 10.0 100.0% 0 93.23s 7,374 463 120,474

त्वरित तुलना

तुलना जोड़ी बदलें