नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 4.8 (medium) vs GPT-6 Luna (medium)

average score लगभग बराबर है: 8.3 vs 8.3. GPT-6 Luna (medium) की benchmark लागत कम है: $0.047 vs $3.490. Claude Opus 4.8 (medium) तेज है: 16.72s vs 18.07s, pass rates 82.6% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-09

तुलना किए गए मॉडल

रैंक
#84
कुल आउटपुट टोकन
67,522
प्रतिक्रिया समय (औसत)
16.72s
कुल लागत
$3.490
रैंक
#83
कुल आउटपुट टोकन
53,161
प्रतिक्रिया समय (औसत)
18.07s
कुल लागत
$0.047
अनुशंसित मॉडल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 74.4x less than Claude Opus 4.8 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 medium रिलीज़: 2026-05-28 GPT-6 Luna GPT-6 Luna medium रिलीज़: 2026-09-23
स्कोर 8.3 8.3
रैंक #84 #83
विश्वसनीयता 10.0 10.0
संगति 9.0 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 82.6% 73.9%
अस्थिर टेस्ट 3 3
कुल रन 69 69
प्रति परिणाम लागत 20.527 0.313
कुल लागत $3.490 $0.047
इनपुट कीमत $5.000 / 1M $0.100 / 1M
आउटपुट कीमत $25.000 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.500 / 1M $0.010 / 1M
कैश लिखने की कीमत $6.250 / 1M $0.125 / 1M
कुल इनपुट टोकन 360,294 203,193
आउटपुट टोकन 43,441 5,751
रीजनिंग टोकन 24,401 47,410
प्रतिक्रिया समय (औसत) 16.72s 18.07s
प्रतिक्रिया समय (अधिकतम) 99.37s 66.44s
प्रतिक्रिया समय (कुल) 384.66s 415.53s
पैरामीटर ~5T कुल (~500B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#84 Claude Opus 4.8

medium
लागत
$0.057
समय
23.1s
टोकन
2,412 tok

#83 GPT-6 Luna

medium
लागत
$0.002
समय
23.6s
टोकन
2,966 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 10.0 10.0 100.0% 0 15.33s 10,590 9,945 1,381
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

तुलना जोड़ी बदलें