नेविगेशन
AI BENCHY
Advertise here

OpenAI: GPT-5.6 Luna vs xAI: Grok Build 0.1

average score लगभग बराबर है: 7.6 vs 7.6. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.352 vs $1.097. GPT-5.6 Luna (medium) तेज है: 7.28s vs 52.06s, pass rates 65.2% vs 63.6%.

अनुशंसित मॉडलGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 3.1x less than Grok Build 0.1 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

तुलना सारांश

रैंक
#57
कुल आउटपुट टोकन
43,679
प्रतिक्रिया समय (औसत)
7.28s
कुल लागत
$0.352
रैंक
#55
कुल आउटपुट टोकन
494,663
प्रतिक्रिया समय (औसत)
52.06s
कुल लागत
$1.097

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 Grok Build 0.1 Grok Build 0.1 medium रिलीज़: 2026-05-21
स्कोर 7.6 7.6
रैंक #57 #55
विश्वसनीयता 10.0 10.0
संगति 9.6 10.0
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.6%
अस्थिर टेस्ट 1 0
कुल रन 66 66
प्रति परिणाम लागत 2.513 7.830
कुल लागत $0.352 $1.097
इनपुट कीमत $1.000 / 1M $1.000 / 1M
आउटपुट कीमत $6.000 / 1M $2.000 / 1M
कुल इनपुट टोकन 89,676 106,751
आउटपुट टोकन 5,699 7,993
रीजनिंग टोकन 37,980 486,670
प्रतिक्रिया समय (औसत) 7.28s 52.06s
प्रतिक्रिया समय (अधिकतम) 29.85s 252.69s
प्रतिक्रिया समय (कुल) 160.27s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#55 xAI: Grok Build 0.1

medium
लागत
$0.028
समय
81.3s
टोकन
14,009 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

त्वरित तुलना

तुलना जोड़ी बदलें