- रैंक
- #18
- कुल आउटपुट टोकन
- 28,540
- प्रतिक्रिया समय (औसत)
- 10.15s
- कुल लागत
- $1.257
GPT-5.5 (low) vs Grok 4.6 (high)
average score लगभग बराबर है: 9.3 vs 9.3. GPT-5.5 (low) की benchmark लागत कम है: $1.257 vs $1.908. GPT-5.5 (low) तेज है: 10.15s vs 84.15s, pass rates 86.4% vs 86.4%.
तुलना किए गए मॉडल
- रैंक
- #19
- कुल आउटपुट टोकन
- 282,217
- प्रतिक्रिया समय (औसत)
- 84.15s
- कुल लागत
- $1.908
अनुशंसित मॉडल
GPT-5.5 (low)
It has the best score here (9.3), while costing about 1.5x less than Grok 4.6 (high).
विस्तृत तुलना
| मेट्रिक | GPT-5.5 GPT-5.5 low | Grok 4.6 Grok 4.6 high |
|---|---|---|
| स्कोर | 9.3 | 9.3 |
| रैंक | #18 | #19 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 10.0 | 10.0 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 86.4% | 86.4% |
| अस्थिर टेस्ट | 0 | 0 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 6.614 | 10.042 |
| कुल लागत | $1.257 | $1.908 |
| इनपुट कीमत | $5.000 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $30.000 / 1M | $6.000 / 1M |
| कुल इनपुट टोकन | 80,067 | 107,275 |
| आउटपुट टोकन | 5,378 | 5,094 |
| रीजनिंग टोकन | 23,162 | 277,123 |
| प्रतिक्रिया समय (औसत) | 10.15s | 84.15s |
| प्रतिक्रिया समय (अधिकतम) | 56.19s | 618.49s |
| प्रतिक्रिया समय (कुल) | 223.24s | 1851.26s |
| पैरामीटर | ~1.5T कुल (~100B सक्रिय) | ~1.7T कुल (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#18 GPT-5.5
low- लागत
- $0.068
- समय
- 37.0s
- टोकन
- 2,339 tok
#19 SpaceXAI: Grok 4.6
high- लागत
- $0.107
- समय
- 265.1s
- टोकन
- 18,001 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Claude Opus 5.5lowvsGrok 4.6highGPT-6 AstramediumvsGrok 4.6highGPT-5.6 SolmediumvsGrok 4.6highGPT-6 SolmediumvsGrok 4.6highClaude Opus 5.5highvsGPT-5.5lowGemini 3.7 FlashmediumvsGPT-5.5lowGemini 3.5 FlashhighvsGPT-5.5lowGemini 3.7 FlashmediumvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGPT-5.5lowGemini 3.7 FlashlowvsGrok 4.6highClaude Opus 5mediumvsGrok 4.6high