नेविगेशन
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.7 (low)

average score लगभग बराबर है: 7.4 vs 7.4. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.101 vs $2.263. GPT-5.6 Luna (medium) तेज है: 9.64s vs 63.19s, pass rates 62.3% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#122
कुल आउटपुट टोकन
47,986
प्रतिक्रिया समय (औसत)
9.64s
कुल लागत
$0.101
रैंक
#127
कुल आउटपुट टोकन
255,329
प्रतिक्रिया समय (औसत)
63.19s
कुल लागत
$2.263
अनुशंसित मॉडल GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 22.6x less than Grok 4.7 (low).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 Grok 4.7 Grok 4.7 low रिलीज़: 2026-09-21
स्कोर 7.4 7.4
रैंक #122 #127
विश्वसनीयता 10.0 10.0
संगति 9.0 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 62.3% 73.9%
अस्थिर टेस्ट 3 5
कुल रन 69 69
प्रति परिणाम लागत 2.822 13.804
कुल लागत $0.101 $2.263
इनपुट कीमत $0.200 / 1M $2.000 / 1M
आउटपुट कीमत $1.200 / 1M $6.000 / 1M
कुल इनपुट टोकन 212,780 365,119
आउटपुट टोकन 6,849 8,118
रीजनिंग टोकन 41,137 247,211
प्रतिक्रिया समय (औसत) 9.64s 63.19s
प्रतिक्रिया समय (अधिकतम) 58.09s 389.63s
प्रतिक्रिया समय (कुल) 221.62s 1453.28s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#127 SpaceXAI: Grok 4.7

low
लागत
$0.007
समय
15.2s
टोकन
1,537 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053

त्वरित तुलना

तुलना जोड़ी बदलें