- रैंक
- #4
- कुल आउटपुट टोकन
- 58,145
- प्रतिक्रिया समय (औसत)
- 61.16s
- कुल लागत
- $0.740
GPT-6.1 Sol — max बनाम medium
max average score में आगे है: 9.9 vs 9.6. medium की benchmark लागत कम है: $0.326 vs $0.740. medium तेज है: 6.99s vs 61.16s, pass rates 95.5% vs 93.9%.
तुलना किए गए मॉडल
- रैंक
- #11
- कुल आउटपुट टोकन
- 16,852
- प्रतिक्रिया समय (औसत)
- 6.99s
- कुल लागत
- $0.326
अनुशंसित मॉडल
medium
Its score stays close to the best score here (9.6 vs 9.9), while costing about 2.3x less than GPT-6.1 Sol (max).
विस्तृत तुलना
| मेट्रिक | GPT-6.1 Sol GPT-6.1 Sol max | GPT-6.1 Sol GPT-6.1 Sol medium |
|---|---|---|
| स्कोर | 9.9 | 9.6 |
| रैंक | #4 | #11 |
| विश्वसनीयता | 9.6 | 10.0 |
| संगति | 10.0 | 9.6 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 95.5% | 93.9% |
| अस्थिर टेस्ट | 0 | 1 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 3.523 | 1.627 |
| कुल लागत | $0.740 | $0.326 |
| इनपुट कीमत | $2.000 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $10.000 / 1M | $10.000 / 1M |
| कुल इनपुट टोकन | 79,136 | 78,368 |
| आउटपुट टोकन | 4,913 | 4,354 |
| रीजनिंग टोकन | 53,232 | 12,498 |
| प्रतिक्रिया समय (औसत) | 61.16s | 6.99s |
| प्रतिक्रिया समय (अधिकतम) | 960.01s | 50.74s |
| प्रतिक्रिया समय (कुल) | 1345.41s | 153.75s |
| पैरामीटर | ~2T कुल (~150B सक्रिय) | ~2T कुल (~150B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#4 GPT-6.1 Sol
max- लागत
- $0.272
- समय
- 584.0s
- टोकन
- 27,273 tok
#11 GPT-6.1 Sol
medium- लागत
- $0.045
- समय
- 72.7s
- टोकन
- 4,581 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
| एंटी-एआई ट्रिक्स | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 5.41s | 606 | 172 | 2,226 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.64s | 606 | 160 | 319 |
| कोडिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 13.57s | 7,302 | 398 | 7,668 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 4.74s | 7,302 | 393 | 1,710 |
| संयुक्त | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 69.59s | 56,240 | 3,352 | 20,103 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 13.62s | 55,160 | 2,807 | 997 |
| डेटा पार्सिंग और निष्कर्षण | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 4.97s | 7,140 | 234 | 995 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 1.76s | 7,140 | 222 | 0 |
| डोमेन-विशिष्ट | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 7.7 | 10.0 | 66.7% | 0 | 352.00s | 420 | 42 | 12,709 | |
| GPT-6.1 Sol | 7.7 | 10.0 | 66.7% | 0 | 23.84s | 732 | 69 | 8,480 |
| Samanya Buddhimatta | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 16.57s | 477 | 113 | 2,266 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 3.09s | 477 | 113 | 137 |
| निर्देश पालन | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 5.54s | 660 | 93 | 1,182 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 3.11s | 660 | 93 | 234 |
| पहेली समाधान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 7.67s | 642 | 215 | 2,455 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.99s | 642 | 221 | 328 |
| टूल कॉलिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 16.02s | 5,454 | 264 | 2,249 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 4.59s | 5,454 | 246 | 0 |
| सामान्य ज्ञान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 11.27s | 195 | 30 | 1,379 | |
| GPT-6.1 Sol | 4.7 | 1.6 | 66.7% | 1 | 3.83s | 195 | 30 | 293 |
त्वरित तुलना
तुलना जोड़ी बदलें
Gemini 3.8 FlashhighvsGPT-6.1 SolmaxGemini 3.6 FlashhighvsGPT-6.1 SolmaxGemini 3.7 FlashhighvsGPT-6.1 SolmaxGemini 3.6 FlashmediumvsGPT-6.1 SolmaxGemini 3.5 FlashhighvsGPT-6.1 SolmediumGemini 3.7 FlashhighvsGPT-6.1 SolmediumGPT-6.1 SolmediumvsGrok 4.6highClaude Opus 5.5lowvsGPT-6.1 SolmediumClaude Opus 5.5highvsGPT-6.1 SolmediumGemini 3.8 FlashhighvsGPT-6.1 SolmediumGemini 3.6 FlashhighvsGPT-6.1 SolmediumGemini 3.7 FlashlowvsGPT-6.1 Solmedium