नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna vs Hy4 preview (low)

Hy4 preview (low) average score में आगे है: 5.6 vs 5.4. GPT-5.6 Luna की benchmark लागत कम है: $0.029 vs $1.745. GPT-5.6 Luna तेज है: 1.50s vs 214.25s, pass rates 36.4% vs 19.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#241
कुल आउटपुट टोकन
6,709
प्रतिक्रिया समय (औसत)
1.50s
कुल लागत
$0.029
रैंक
#233
कुल आउटपुट टोकन
682,538
प्रतिक्रिया समय (औसत)
214.25s
कुल लागत
$1.745
अनुशंसित मॉडल GPT-5.6 Luna

Its score stays close to the best score here (5.4 vs 5.6), while costing about 61.6x less than Hy4 preview (low).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09 Hy4 preview Hy4 preview low रिलीज़: 2026-08-29
स्कोर 5.4 5.6
रैंक #241 #233
विश्वसनीयता 10.0 5.4
संगति 8.8 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 36.4% 19.7%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 2.357 58.157
कुल लागत $0.029 $1.745
इनपुट कीमत $0.200 / 1M $0.834 / 1M
आउटपुट कीमत $1.200 / 1M $2.501 / 1M
कुल इनपुट टोकन 101,332 45,154
आउटपुट टोकन 6,709 4,022
रीजनिंग टोकन 0 678,516
प्रतिक्रिया समय (औसत) 1.50s 214.25s
प्रतिक्रिया समय (अधिकतम) 10.57s 597.45s
प्रतिक्रिया समय (कुल) 33.05s 4713.56s
पैरामीटर ~400B कुल (~17B सक्रिय) 770B कुल (49B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#241 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

#233 Hy4 preview

low
Provider returned error
लागत
$0.000
समय
1.1s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Hy4 preview 5.2 8.6 0.0% 0 219.15s 6,110 135 96,407

त्वरित तुलना

तुलना जोड़ी बदलें