- क्रमांक
- #118
- एकूण आउटपुट टोकन्स
- 4,915
- प्रतिसाद वेळ (सरासरी)
- 2.35s
- एकूण खर्च
- $0.544
GPT-5.5 vs Grok 4.20 (medium)
average score जवळपास समान आहे: 7.0 vs 7.0. GPT-5.5 चा benchmark खर्च कमी आहे: $0.544 vs $0.805. GPT-5.5 वेगवान आहे: 2.35s vs 32.56s, pass rates 59.1% vs 60.6%.
- क्रमांक
- #120
- एकूण आउटपुट टोकन्स
- 270,259
- प्रतिसाद वेळ (सरासरी)
- 32.56s
- एकूण खर्च
- $0.805
शिफारस केलेले मॉडेल
GPT-5.5
It has the best score here (7.0), while responding about 13.8x faster than Grok 4.20 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.5 GPT-5.5 none | Grok 4.20 Grok 4.20 medium |
|---|---|---|
| स्कोअर | 7.0 | 7.0 |
| क्रमांक | #118 | #120 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 9.2 | 8.2 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 59.1% | 60.6% |
| अस्थिर चाचण्या | 2 | 5 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 4.533 | 10.365 |
| एकूण खर्च | $0.544 | $0.805 |
| इनपुट किंमत | $5.000 / 1M | $1.250 / 1M |
| आउटपुट किंमत | $30.000 / 1M | $2.500 / 1M |
| एकूण इनपुट टोकन्स | 79,294 | 102,986 |
| आउटपुट टोकन्स | 4,915 | 5,860 |
| रिझनिंग टोकन्स | 0 | 264,399 |
| प्रतिसाद वेळ (सरासरी) | 2.35s | 32.56s |
| प्रतिसाद वेळ (कमाल) | 12.24s | 199.66s |
| प्रतिसाद वेळ (एकूण) | 51.78s | 716.36s |
| पॅरामीटर्स | ~1.5T एकूण (~100B सक्रिय) | ~1T एकूण (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#118 GPT-5.5
none- खर्च
- $0.090
- वेळ
- 54.3s
- टोकन्स
- 3,063 tok
#120 SpaceXAI: Grok 4.20
medium- खर्च
- $0.041
- वेळ
- 110.3s
- टोकन्स
- 16,336 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Mercury 2mediumvsGPT-5.5noneGPT-5.5nonevsGLM 5.1mediumDeepSeek V3.2mediumvsGPT-5.5noneSeed-2.0-MinimediumvsGPT-5.5noneKimi K2.5mediumvsGPT-5.5noneGPT-5.5nonevsGrok 4.3mediumGPT-5.6 SolnonevsGrok 4.20mediumKAT-Coder-Pro V2.5mediumvsGPT-5.5noneSeed-2.0-CodehighvsGrok 4.20mediumGPT-5.5nonevsQwen3.7 FlashmediumSeed-2.0-CodehighvsGPT-5.5noneGPT-5.5nonevsSolar Pro 4high