नेव्हिगेशन
AI BENCHY
Advertise here

OpenAI: GPT-5.6 Luna vs xAI: Grok Build 0.1

average score जवळपास समान आहे: 7.6 vs 7.6. GPT-5.6 Luna (medium) चा benchmark खर्च कमी आहे: $0.352 vs $1.097. GPT-5.6 Luna (medium) वेगवान आहे: 7.28s vs 52.06s, pass rates 65.2% vs 63.6%.

शिफारस केलेले मॉडेलGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 3.1x less than Grok Build 0.1 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

तुलना सारांश

क्रमांक
#57
एकूण आउटपुट टोकन्स
43,679
प्रतिसाद वेळ (सरासरी)
7.28s
एकूण खर्च
$0.352
क्रमांक
#55
एकूण आउटपुट टोकन्स
494,663
प्रतिसाद वेळ (सरासरी)
52.06s
एकूण खर्च
$1.097

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium प्रकाशन: 2026-07-09 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 7.6 7.6
क्रमांक #57 #55
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 63.6%
अस्थिर चाचण्या 1 0
एकूण रन 66 66
प्रति निकाल खर्च 2.513 7.830
एकूण खर्च $0.352 $1.097
इनपुट किंमत $1.000 / 1M $1.000 / 1M
आउटपुट किंमत $6.000 / 1M $2.000 / 1M
एकूण इनपुट टोकन्स 89,676 106,751
आउटपुट टोकन्स 5,699 7,993
रिझनिंग टोकन्स 37,980 486,670
प्रतिसाद वेळ (सरासरी) 7.28s 52.06s
प्रतिसाद वेळ (कमाल) 29.85s 252.69s
प्रतिसाद वेळ (एकूण) 160.27s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 GPT-5.6 Luna

medium
खर्च
$0.014
वेळ
14.6s
टोकन्स
2,362 tok

#55 xAI: Grok Build 0.1

medium
खर्च
$0.028
वेळ
81.3s
टोकन्स
14,009 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

झटपट तुलना

तुलना जोडी बदला