- क्रमांक
- #185
- एकूण आउटपुट टोकन्स
- 6,197
- प्रतिसाद वेळ (सरासरी)
- 4.75s
- एकूण खर्च
- $1.212
GPT-5.5 vs Grok 4.7 (high)
average score जवळपास समान आहे: 6.6 vs 6.7. GPT-5.5 चा benchmark खर्च कमी आहे: $1.212 vs $3.582. GPT-5.5 वेगवान आहे: 4.75s vs 122.19s, pass rates 56.5% vs 72.5%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #179
- एकूण आउटपुट टोकन्स
- 487,184
- प्रतिसाद वेळ (सरासरी)
- 122.19s
- एकूण खर्च
- $3.582
शिफारस केलेले मॉडेल
GPT-5.5
It has the best score here (6.6), while costing about 3.0x less than Grok 4.7 (high).
तपशीलवार तुलना
| मेट्रिक | GPT-5.5 GPT-5.5 none | Grok 4.7 Grok 4.7 high |
|---|---|---|
| स्कोअर | 6.6 | 6.7 |
| क्रमांक | #185 | #179 |
| विश्वसनीयता | 10.0 | 9.6 |
| सुसंगतता | 9.3 | 7.7 |
| प्रयत्न | 69/69 | 69/69 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 56.5% | 72.5% |
| अस्थिर चाचण्या | 2 | 7 |
| एकूण रन | 69 | 69 |
| प्रति निकाल खर्च | 10.096 | 23.360 |
| एकूण खर्च | $1.212 | $3.582 |
| इनपुट किंमत | $5.000 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $30.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 205,108 | 329,276 |
| आउटपुट टोकन्स | 6,197 | 8,172 |
| रिझनिंग टोकन्स | 0 | 479,012 |
| प्रतिसाद वेळ (सरासरी) | 4.75s | 122.19s |
| प्रतिसाद वेळ (कमाल) | 57.53s | 573.57s |
| प्रतिसाद वेळ (एकूण) | 109.31s | 2810.40s |
| पॅरामीटर्स | ~1.5T एकूण (~100B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#185 GPT-5.5
none- खर्च
- $0.090
- वेळ
- 54.3s
- टोकन्स
- 3,063 tok
#179 SpaceXAI: Grok 4.7
high- खर्च
- $0.110
- वेळ
- 301.3s
- टोकन्स
- 23,143 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
MiniMax M3mediumvsGrok 4.7highGPT-5.5nonevsGLM 5.3 FlashlowEmber-1maxvsGrok 4.7highGPT 5.3 ChatnonevsGrok 4.7highGPT-5.6 SolnonevsGrok 4.7highSolar Pro 4lowvsGrok 4.7highQwen3.5-FlashnonevsGrok 4.7highGPT-5.5nonevsQwen3.7 FlashmediumEmber-1maxvsGPT-5.5noneGrok 4.7highvsGLM 5.3 FlashlowMiniMax M3mediumvsGPT-5.5noneLongCat 2.0lowvsGPT-5.5none