- क्रमांक
- #79
- एकूण आउटपुट टोकन्स
- 108,019
- प्रतिसाद वेळ (सरासरी)
- 27.64s
- एकूण खर्च
- $0.241
GPT-5 Mini (medium) vs Qwen3.8 2.4T A95B (low)
average score जवळपास समान आहे: 8.1 vs 8.1. GPT-5 Mini (medium) चा benchmark खर्च कमी आहे: $0.241 vs $2.672. GPT-5 Mini (medium) वेगवान आहे: 27.64s vs 118.97s, pass rates 65.2% vs 72.7%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #78
- एकूण आउटपुट टोकन्स
- 495,541
- प्रतिसाद वेळ (सरासरी)
- 118.97s
- एकूण खर्च
- $2.672
शिफारस केलेले मॉडेल
GPT-5 Mini (medium)
It has the best score here (8.1), while costing about 11.1x less than Qwen3.8 2.4T A95B (low).
तपशीलवार तुलना
| मेट्रिक | GPT-5 Mini GPT-5 Mini medium | Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low |
|---|---|---|
| स्कोअर | 8.1 | 8.1 |
| क्रमांक | #79 | #78 |
| विश्वसनीयता | 10.0 | 9.4 |
| सुसंगतता | 8.4 | 9.2 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 65.2% | 72.7% |
| अस्थिर चाचण्या | 4 | 2 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 2.006 | 17.812 |
| एकूण खर्च | $0.241 | $2.672 |
| इनपुट किंमत | $0.250 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $2.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 98,383 | 113,279 |
| आउटपुट टोकन्स | 14,409 | 121,045 |
| रिझनिंग टोकन्स | 93,610 | 374,496 |
| प्रतिसाद वेळ (सरासरी) | 27.64s | 118.97s |
| प्रतिसाद वेळ (कमाल) | 111.48s | 534.21s |
| प्रतिसाद वेळ (एकूण) | 608.02s | 2617.41s |
| पॅरामीटर्स | ~400B एकूण (~17B सक्रिय) | 2.4T एकूण (95B सक्रिय) |
| उपलब्धता | बंद स्रोत | वेट्स उपलब्ध |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#79 GPT-5 Mini
medium- खर्च
- $0.007
- वेळ
- 42.9s
- टोकन्स
- 3,432 tok
#78 Qwen3.8 2.4T A95B
low- खर्च
- $0.100
- वेळ
- 193.2s
- टोकन्स
- 16,767 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
| अँटी-एआय युक्त्या | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 7.1 | 7.6 | 66.7% | 1 | 13.86s | 606 | 1,715 | 6,378 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 22.04s | 1,104 | 397 | 4,814 |
| कोडिंग | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 27.63s | 7,302 | 658 | 17,152 | |
| Qwen3.8 2.4T A95B | 7.8 | 9.3 | 66.7% | 0 | 172.53s | 6,716 | 21,405 | 57,399 |
| संयुक्त | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 7.3 | 5.8 | 83.3% | 1 | 99.82s | 75,392 | 8,387 | 35,328 | |
| Qwen3.8 2.4T A95B | 8.2 | 6.9 | 66.7% | 1 | 231.85s | 85,267 | 8,008 | 50,681 |
| डेटा पार्सिंग आणि निष्कर्षण | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 12.58s | 7,140 | 453 | 3,200 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 22.27s | 7,956 | 839 | 2,445 |
| डोमेन-विशिष्ट | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 3.5 | 4.4 | 33.3% | 2 | 44.66s | 524 | 268 | 16,128 | |
| Qwen3.8 2.4T A95B | 3.2 | 9.3 | 0.0% | 0 | 287.65s | 1,008 | 16,133 | 156,114 |
| Samanya Buddhimatta | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 4.5 | 10.0 | 0.0% | 0 | 13.50s | 477 | 349 | 1,856 | |
| Qwen3.8 2.4T A95B | 6.1 | 3.1 | 66.7% | 1 | 22.97s | 606 | 44 | 1,497 |
| सूचनांचे पालन | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 11.59s | 660 | 310 | 3,968 | |
| Qwen3.8 2.4T A95B | 9.8 | 10.0 | 100.0% | 0 | 19.54s | 903 | 263 | 1,480 |
| कोडी सोडवणे | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 5.6 | 9.8 | 33.3% | 0 | 15.20s | 642 | 1,622 | 6,144 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 43.37s | 1,026 | 1,154 | 25,563 |
| टूल कॉलिंग | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 18.64s | 5,445 | 487 | 1,600 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 25.88s | 8,481 | 302 | 975 |
| सामान्य ज्ञान | स्कोअर | सुसंगतता | प्रति प्रयत्न पास दर | अस्थिर चाचण्या | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) | इनपुट टोकन्स | आउटपुट टोकन्स | रिझनिंग टोकन्स |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5 Mini | 3.0 | 10.0 | 0.0% | 0 | 9.99s | 195 | 160 | 1,856 | |
| Qwen3.8 2.4T A95B | 3.0 | 10.0 | 0.0% | 0 | 422.46s | 212 | 72,500 | 73,528 |
झटपट तुलना
तुलना जोडी बदला
Muse Glimmer 30BxhighvsGPT-5 MinimediumMuse Glimmer 30BxhighvsQwen3.8 2.4T A95BlowGPT-5 MinimediumvsInklinghighQwen3.8 2.4T A95BlowvsGrok 4.7mediumMuse Spark 1.1highvsGPT-5 MinimediumQwen3.8 2.4T A95BlowvsInklinghighMuse Spark 1.1highvsQwen3.8 2.4T A95BlowDeepSeek V4 Flash 0731lowvsGPT-5 MinimediumDeepSeek V4 Flash 0731highvsGPT-5 MinimediumDeepSeek V4 Flash 0731highvsQwen3.8 2.4T A95BlowGPT-5 MinimediumvsGLM 5.2highClaude Sonnet 5mediumvsQwen3.8 2.4T A95Blow