नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.1 Pro Preview (medium) vs GPT-6 Luna (medium)

Gemini 3.1 Pro Preview (medium) average score में आगे है: 8.4 vs 8.3. GPT-6 Luna (medium) की benchmark लागत कम है: $0.047 vs $1.585. GPT-6 Luna (medium) तेज है: 18.07s vs 22.71s, pass rates 89.9% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-02

तुलना किए गए मॉडल

रैंक
#71
कुल आउटपुट टोकन
102,691
प्रतिक्रिया समय (औसत)
22.71s
कुल लागत
$1.585
रैंक
#79
कुल आउटपुट टोकन
53,161
प्रतिक्रिया समय (औसत)
18.07s
कुल लागत
$0.047
अनुशंसित मॉडल GPT-6 Luna (medium)

Its score stays close to the best score here (8.3 vs 8.4), while costing about 33.8x less than Gemini 3.1 Pro Preview (medium).

विस्तृत तुलना

मेट्रिक Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium रिलीज़: 2026-02-19 GPT-6 Luna GPT-6 Luna medium रिलीज़: 2026-09-23
स्कोर 8.4 8.3
रैंक #71 #79
विश्वसनीयता 9.8 10.0
संगति 9.6 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 89.9% 73.9%
अस्थिर टेस्ट 1 3
कुल रन 69 69
प्रति परिणाम लागत 7.924 0.313
कुल लागत $1.585 $0.047
इनपुट कीमत $2.000 / 1M $0.100 / 1M
आउटपुट कीमत $12.000 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.200 / 1M $0.010 / 1M
कैश लिखने की कीमत $0.375 / 1M $0.125 / 1M
कुल इनपुट टोकन 176,208 203,193
आउटपुट टोकन 6,093 5,751
रीजनिंग टोकन 96,598 47,410
प्रतिक्रिया समय (औसत) 22.71s 18.07s
प्रतिक्रिया समय (अधिकतम) 88.68s 66.44s
प्रतिक्रिया समय (कुल) 386.11s 415.53s
पैरामीटर ~1.2T कुल (~20B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Gemini 3.1 Pro Preview

medium
लागत
$0.115
समय
87.2s
टोकन
9,629 tok

#79 GPT-6 Luna

medium
लागत
$0.002
समय
23.6s
टोकन
2,966 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

त्वरित तुलना

तुलना जोड़ी बदलें