- रैंक
- #35
- कुल आउटपुट टोकन
- 170,373
- प्रतिक्रिया समय (औसत)
- 66.52s
- कुल लागत
- $1.132
Qwen3.6 Max Preview (medium) vs Grok 4.5 (low)
Qwen3.6 Max Preview (medium) average score में आगे है: 8.6 vs 8.4. Grok 4.5 (low) की benchmark लागत कम है: $0.945 vs $1.132. Grok 4.5 (low) तेज है: 16.17s vs 66.52s, pass rates 83.3% vs 77.3%.
- रैंक
- #41
- कुल आउटपुट टोकन
- 115,489
- प्रतिक्रिया समय (औसत)
- 16.17s
- कुल लागत
- $0.945
अनुशंसित मॉडल
Grok 4.5 (low)
Its score stays close to the best score here (8.4 vs 8.6), while responding about 4.1x faster than Qwen3.6 Max Preview (medium).
विस्तृत तुलना
| मेट्रिक | Qwen3.6 Max Preview Qwen3.6 Max Preview medium | Grok 4.5 Grok 4.5 low |
|---|---|---|
| स्कोर | 8.6 | 8.4 |
| रैंक | #35 | #41 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 9.3 | 9.3 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 83.3% | 77.3% |
| अस्थिर टेस्ट | 2 | 2 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 7.653 | 5.901 |
| कुल लागत | $1.132 | $0.945 |
| इनपुट कीमत | $1.028 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $6.162 / 1M | $6.000 / 1M |
| कुल इनपुट टोकन | 79,249 | 125,605 |
| आउटपुट टोकन | 5,097 | 7,505 |
| रीजनिंग टोकन | 165,276 | 107,984 |
| प्रतिक्रिया समय (औसत) | 66.52s | 16.17s |
| प्रतिक्रिया समय (अधिकतम) | 238.07s | 205.28s |
| प्रतिक्रिया समय (कुल) | 1463.50s | 355.67s |
| पैरामीटर | ~1T कुल (~40B सक्रिय) | ~1.7T कुल (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#35 Qwen3.6 Max Preview
medium- लागत
- $0.024
- समय
- 76.5s
- टोकन
- 3,861 tok
#41 SpaceXAI: Grok 4.5
low- लागत
- $0.011
- समय
- 12.4s
- टोकन
- 2,018 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
| एंटी-एआई ट्रिक्स | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 22.13s | 672 | 228 | 10,075 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 2.75s | 2,991 | 261 | 3,000 |
| कोडिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 8.8 | 7.8 | 88.9% | 1 | 146.48s | 7,895 | 427 | 52,957 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 13.72s | 9,579 | 303 | 15,641 |
| संयुक्त | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 7.3 | 5.8 | 83.3% | 1 | 177.48s | 51,812 | 3,215 | 35,050 | |
| Grok 4.5 | 6.5 | 10.0 | 50.0% | 0 | 12.75s | 82,028 | 6,031 | 3,583 |
| डेटा पार्सिंग और निष्कर्षण | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 41.15s | 7,782 | 270 | 10,106 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 3.44s | 8,937 | 225 | 2,549 |
| डोमेन-विशिष्ट | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 5.3 | 10.0 | 33.3% | 0 | 88.53s | 780 | 59 | 30,805 | |
| Grok 4.5 | 2.9 | 7.2 | 11.1% | 1 | 77.09s | 2,523 | 14 | 71,813 |
| Samanya Buddhimatta | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 32.24s | 516 | 129 | 3,510 | |
| Grok 4.5 | 6.1 | 3.1 | 66.7% | 1 | 4.88s | 1,077 | 98 | 1,253 |
| निर्देश पालन | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.31s | 699 | 103 | 5,848 | |
| Grok 4.5 | 9.8 | 10.0 | 100.0% | 0 | 2.80s | 1,857 | 57 | 1,878 |
| पहेली समाधान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 24.32s | 696 | 329 | 7,693 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 3.20s | 2,430 | 217 | 2,590 |
| टूल कॉलिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 10.0 | 10.0 | 100.0% | 0 | 18.32s | 8,193 | 309 | 1,571 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 5.83s | 13,394 | 284 | 871 |
| सामान्य ज्ञान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Max Preview | 3.0 | 10.0 | 0.0% | 0 | 60.56s | 204 | 28 | 7,661 | |
| Grok 4.5 | 3.0 | 10.0 | 0.0% | 0 | 13.98s | 789 | 15 | 4,806 |
त्वरित तुलना
तुलना जोड़ी बदलें
GPT-5.2mediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.5lowSeed 2.1 TurbomediumvsGrok 4.5lowInkling SmallhighvsGrok 4.5lowMuse Spark 1.2highvsQwen3.6 Max PreviewmediumMuse Spark 1.2lowvsQwen3.6 Max PreviewmediumGPT-5.4mediumvsGrok 4.5lowQwen3.6 Max PreviewmediumvsGLM 5.3 FlashmaxGemini 3.6 FlashlowvsQwen3.6 Max PreviewmediumClaude Opus 5lowvsQwen3.6 Max PreviewmediumGemini 2.5 FlashmediumvsGrok 4.5lowGemini 3.5 Flash LitehighvsQwen3.6 Max Previewmedium