- क्रमांक
- #118
- एकूण आउटपुट टोकन्स
- 4,915
- प्रतिसाद वेळ (सरासरी)
- 2.35s
- एकूण खर्च
- $0.544
GPT-5.5 vs Grok 4.3 (medium)
average score जवळपास समान आहे: 7.0 vs 7.0. GPT-5.5 चा benchmark खर्च कमी आहे: $0.544 vs $0.741. GPT-5.5 वेगवान आहे: 2.35s vs 44.21s, pass rates 59.1% vs 66.7%.
- क्रमांक
- #114
- एकूण आउटपुट टोकन्स
- 225,904
- प्रतिसाद वेळ (सरासरी)
- 44.21s
- एकूण खर्च
- $0.741
शिफारस केलेले मॉडेल
GPT-5.5
It has the best score here (7.0), while responding about 18.8x faster than Grok 4.3 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.5 GPT-5.5 none | Grok 4.3 Grok 4.3 medium |
|---|---|---|
| स्कोअर | 7.0 | 7.0 |
| क्रमांक | #118 | #114 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 9.2 | 8.2 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 59.1% | 66.7% |
| अस्थिर चाचण्या | 2 | 5 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 4.533 | 6.168 |
| एकूण खर्च | $0.544 | $0.741 |
| इनपुट किंमत | $5.000 / 1M | $1.250 / 1M |
| आउटपुट किंमत | $30.000 / 1M | $2.500 / 1M |
| एकूण इनपुट टोकन्स | 79,294 | 140,244 |
| आउटपुट टोकन्स | 4,915 | 13,739 |
| रिझनिंग टोकन्स | 0 | 212,165 |
| प्रतिसाद वेळ (सरासरी) | 2.35s | 44.21s |
| प्रतिसाद वेळ (कमाल) | 12.24s | 216.69s |
| प्रतिसाद वेळ (एकूण) | 51.78s | 972.64s |
| पॅरामीटर्स | ~1.5T एकूण (~100B सक्रिय) | ~1.5T एकूण (~150B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#118 GPT-5.5
none- खर्च
- $0.090
- वेळ
- 54.3s
- टोकन्स
- 3,063 tok
#114 SpaceXAI: Grok 4.3
medium- खर्च
- $0.009
- वेळ
- 19.0s
- टोकन्स
- 3,661 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Mercury 2mediumvsGPT-5.5noneGPT-5.5nonevsGLM 5.1mediumGPT-5.6 SolnonevsGrok 4.3mediumGPT-5.5nonevsGrok 4.20mediumDeepSeek V3.2mediumvsGPT-5.5noneSeed-2.0-MinimediumvsGPT-5.5noneKimi K2.5mediumvsGPT-5.5noneSolar Pro 4highvsGrok 4.3mediumKAT-Coder-Pro V2.5mediumvsGPT-5.5noneGPT-5.5nonevsQwen3.7 FlashmediumSeed-2.0-CodehighvsGPT-5.5noneStep 3.7 FlashlowvsGrok 4.3medium