- क्रमांक
- #68
- एकूण आउटपुट टोकन्स
- 11,677
- प्रतिसाद वेळ (सरासरी)
- 6.92s
- एकूण खर्च
- $0.273
GPT-6 Sol (low) vs Grok 4.5 (medium)
Grok 4.5 (medium) average score मध्ये पुढे आहे: 8.5 vs 8.4. GPT-6 Sol (low) चा benchmark खर्च कमी आहे: $0.273 vs $2.042. GPT-6 Sol (low) वेगवान आहे: 6.92s vs 68.59s, pass rates 86.4% vs 83.3%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #60
- एकूण आउटपुट टोकन्स
- 299,460
- प्रतिसाद वेळ (सरासरी)
- 68.59s
- एकूण खर्च
- $2.042
शिफारस केलेले मॉडेल
GPT-6 Sol (low)
Its score stays close to the best score here (8.4 vs 8.5), while costing about 7.5x less than Grok 4.5 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-6 Sol GPT-6 Sol low | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| स्कोअर | 8.4 | 8.5 |
| क्रमांक | #68 | #60 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.5 | 8.9 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 86.4% | 83.3% |
| अस्थिर चाचण्या | 4 | 3 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 1.604 | 12.007 |
| एकूण खर्च | $0.273 | $2.042 |
| इनपुट किंमत | $2.000 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $10.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 77,882 | 122,155 |
| आउटपुट टोकन्स | 4,047 | 5,514 |
| रिझनिंग टोकन्स | 7,630 | 293,946 |
| प्रतिसाद वेळ (सरासरी) | 6.92s | 68.59s |
| प्रतिसाद वेळ (कमाल) | 17.91s | 436.38s |
| प्रतिसाद वेळ (एकूण) | 152.17s | 1508.91s |
| पॅरामीटर्स | ~2T एकूण (~150B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#68 GPT-6 Sol
low- खर्च
- $0.018
- वेळ
- 17.4s
- टोकन्स
- 1,850 tok
#60 SpaceXAI: Grok 4.5
medium- खर्च
- $0.044
- वेळ
- 59.4s
- टोकन्स
- 7,512 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-6 SollowvsInkling SmallhighSeed 2.1 TurbomediumvsGPT-6 SollowGPT-6 SollowvsMiMo-V2.6-PromediumDeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumGPT-6 SollowvsQwen3.8 27BhighGPT-6 SollowvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsGPT-6 SollowGPT-6 SollowvsGrok 4.6mediumQwen3.8 27BhighvsGrok 4.5mediumQwen3.8 MaxlowvsGrok 4.5medium