- रैंक
- #28
- कुल आउटपुट टोकन
- 125,316
- प्रतिक्रिया समय (औसत)
- 38.97s
- कुल लागत
- $4.163
GPT-5.5 (medium) vs Pareto
GPT-5.5 (medium) average score में आगे है: 9.0 vs 8.9. Pareto की benchmark लागत कम है: $1.172 vs $4.163. Pareto तेज है: 31.51s vs 38.97s, pass rates 87.9% vs 86.4%.
तुलना किए गए मॉडल
- रैंक
- #34
- कुल आउटपुट टोकन
- 119,230
- प्रतिक्रिया समय (औसत)
- 31.51s
- कुल लागत
- $1.172
अनुशंसित मॉडल
Pareto
Its score stays close to the best score here (8.9 vs 9.0), while costing about 3.6x less than GPT-5.5 (medium).
विस्तृत तुलना
| मेट्रिक | GPT-5.5 GPT-5.5 medium | Pareto Pareto none |
|---|---|---|
| स्कोर | 9.0 | 8.9 |
| रैंक | #28 | #34 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.9 | 9.2 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 87.9% | 86.4% |
| अस्थिर टेस्ट | 3 | 2 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 23.127 | 6.506 |
| कुल लागत | $4.163 | $1.172 |
| इनपुट कीमत | $5.000 / 1M | $2.500 / 1M |
| आउटपुट कीमत | $30.000 / 1M | $7.500 / 1M |
| कुल इनपुट टोकन | 80,668 | 110,734 |
| आउटपुट टोकन | 5,617 | 119,230 |
| रीजनिंग टोकन | 119,699 | 0 |
| प्रतिक्रिया समय (औसत) | 38.97s | 31.51s |
| प्रतिक्रिया समय (अधिकतम) | 332.10s | 143.33s |
| प्रतिक्रिया समय (कुल) | 857.43s | 693.29s |
| पैरामीटर | ~1.5T कुल (~100B सक्रिय) | - |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#28 GPT-5.5
medium- लागत
- $0.112
- समय
- 71.9s
- टोकन
- 3,807 tok
#34 Pareto
none- लागत
- $0.034
- समय
- 170.7s
- टोकन
- 4,581 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Seed 2.1 TurbohighvsParetononeMuse Spark 1.3highvsParetononeClaude Fable 5.1highvsGPT-5.5mediumGPT-5.3-CodexmediumvsParetononeGPT-5.5mediumvsGrok 4.5highQwen3.8 Max (0902)highvsParetononeGPT-5.5mediumvsQwen3.8 Max (0902)highParetononevsGrok 4.5highMuse Spark 1.3highvsGPT-5.5mediumGemini 3.5 FlashlowvsParetononeQwen3.8 MaxmediumvsParetononeSeed 2.1 TurbolowvsGPT-5.5medium