नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6.1 Sol (low) vs Grok 4.5 (medium)

GPT-6.1 Sol (low) average score में आगे है: 9.6 vs 7.8. GPT-6.1 Sol (low) की benchmark लागत कम है: $0.460 vs $2.996. GPT-6.1 Sol (low) तेज है: 7.15s vs 68.44s, pass rates 92.8% vs 79.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-06

तुलना किए गए मॉडल

रैंक
#16
कुल आउटपुट टोकन
13,138
प्रतिक्रिया समय (औसत)
7.15s
कुल लागत
$0.460
रैंक
#107
कुल आउटपुट टोकन
306,044
प्रतिक्रिया समय (औसत)
68.44s
कुल लागत
$2.996
अनुशंसित मॉडल GPT-6.1 Sol (low)

It has the best score here (9.6), while costing about 6.5x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol low रिलीज़: 2026-09-29 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 9.6 7.8
रैंक #16 #107
विश्वसनीयता 10.0 10.0
संगति 9.6 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 92.8% 79.7%
अस्थिर टेस्ट 1 3
कुल रन 69 69
प्रति परिणाम लागत 2.187 14.430
कुल लागत $0.460 $2.996
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कैश पढ़ने की कीमत $0.100 / 1M $0.300 / 1M
कैश लिखने की कीमत $2.500 / 1M लागू नहीं
कुल इनपुट टोकन 163,900 308,369
आउटपुट टोकन 4,958 7,013
रीजनिंग टोकन 8,180 299,031
प्रतिक्रिया समय (औसत) 7.15s 68.44s
प्रतिक्रिया समय (अधिकतम) 46.57s 436.38s
प्रतिक्रिया समय (कुल) 164.47s 1574.14s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#16 GPT-6.1 Sol

low
लागत
$0.028
समय
44.6s
टोकन
2,881 tok

#107 SpaceXAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें