- रैंक
- #68
- कुल आउटपुट टोकन
- 11,677
- प्रतिक्रिया समय (औसत)
- 6.92s
- कुल लागत
- $0.273
GPT-6 Sol (low) vs Grok 4.5 (medium)
Grok 4.5 (medium) average score में आगे है: 8.5 vs 8.4. GPT-6 Sol (low) की benchmark लागत कम है: $0.273 vs $2.042. GPT-6 Sol (low) तेज है: 6.92s vs 68.59s, pass rates 86.4% vs 83.3%.
तुलना किए गए मॉडल
- रैंक
- #60
- कुल आउटपुट टोकन
- 299,460
- प्रतिक्रिया समय (औसत)
- 68.59s
- कुल लागत
- $2.042
अनुशंसित मॉडल
GPT-6 Sol (low)
Its score stays close to the best score here (8.4 vs 8.5), while costing about 7.5x less than Grok 4.5 (medium).
विस्तृत तुलना
| मेट्रिक | GPT-6 Sol GPT-6 Sol low | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| स्कोर | 8.4 | 8.5 |
| रैंक | #68 | #60 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.5 | 8.9 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 86.4% | 83.3% |
| अस्थिर टेस्ट | 4 | 3 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 1.604 | 12.007 |
| कुल लागत | $0.273 | $2.042 |
| इनपुट कीमत | $2.000 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $10.000 / 1M | $6.000 / 1M |
| कुल इनपुट टोकन | 77,882 | 122,155 |
| आउटपुट टोकन | 4,047 | 5,514 |
| रीजनिंग टोकन | 7,630 | 293,946 |
| प्रतिक्रिया समय (औसत) | 6.92s | 68.59s |
| प्रतिक्रिया समय (अधिकतम) | 17.91s | 436.38s |
| प्रतिक्रिया समय (कुल) | 152.17s | 1508.91s |
| पैरामीटर | ~2T कुल (~150B सक्रिय) | ~1.7T कुल (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#68 GPT-6 Sol
low- लागत
- $0.018
- समय
- 17.4s
- टोकन
- 1,850 tok
#60 SpaceXAI: Grok 4.5
medium- लागत
- $0.044
- समय
- 59.4s
- टोकन
- 7,512 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
GPT-6 SollowvsInkling SmallhighSeed 2.1 TurbomediumvsGPT-6 SollowGPT-6 SollowvsMiMo-V2.6-PromediumDeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumGPT-6 SollowvsQwen3.8 27BhighGPT-6 SollowvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsGPT-6 SollowGPT-6 SollowvsGrok 4.6mediumQwen3.8 27BhighvsGrok 4.5mediumQwen3.8 MaxlowvsGrok 4.5medium