नेविगेशन
Advertise here

Claude Opus 4.8 (low) vs GPT-6 Luna (medium)

GPT-6 Luna (medium) average score में आगे है: 7.9 vs 7.8. GPT-6 Luna (medium) की benchmark लागत कम है: $0.031 vs $2.089. Claude Opus 4.8 (low) तेज है: 12.88s vs 15.87s, pass rates 80.3% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#103
कुल आउटपुट टोकन
52,237
प्रतिक्रिया समय (औसत)
12.88s
कुल लागत
$2.089
रैंक
#94
कुल आउटपुट टोकन
45,154
प्रतिक्रिया समय (औसत)
15.87s
कुल लागत
$0.031
अनुशंसित मॉडल GPT-6 Luna (medium)

It has the best score here (7.9), while costing about 68.5x less than Claude Opus 4.8 (low).

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 low रिलीज़: 2026-05-28 GPT-6 Luna GPT-6 Luna medium रिलीज़: 2026-09-23
स्कोर 7.8 7.9
रैंक #103 #94
विश्वसनीयता 10.0 10.0
संगति 8.9 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 80.3% 72.7%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 13.054 0.218
कुल लागत $2.089 $0.031
इनपुट कीमत $5.000 / 1M $0.100 / 1M
आउटपुट कीमत $25.000 / 1M $0.500 / 1M
कुल इनपुट टोकन 156,522 78,946
आउटपुट टोकन 43,056 4,635
रीजनिंग टोकन 9,181 40,519
प्रतिक्रिया समय (औसत) 12.88s 15.87s
प्रतिक्रिया समय (अधिकतम) 127.97s 35.14s
प्रतिक्रिया समय (कुल) 283.32s 349.09s
पैरामीटर ~5T कुल (~500B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#103 Claude Opus 4.8

low
लागत
$0.031
समय
14.1s
टोकन
1,345 tok

#94 GPT-6 Luna

medium
लागत
$0.002
समय
23.6s
टोकन
2,966 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

त्वरित तुलना

तुलना जोड़ी बदलें