नेव्हिगेशन
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs xAI: Grok 4.5

Qwen3.6 Max Preview (medium) average score मध्ये पुढे आहे: 8.4 vs 8.3. Qwen3.6 Max Preview (medium) चा benchmark खर्च कमी आहे: $1.143 vs $1.928. Grok 4.5 (medium) वेगवान आहे: 61.71s vs 67.53s, pass rates 80.3% vs 78.8%.

शिफारस केलेले मॉडेलQwen3.6 Max Preview (medium)It has the best score here (8.4), while costing about 1.7x less than Grok 4.5 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Qwen3.6 Max Preview Qwen3.6 Max Preview medium प्रकाशन: 2026-04-20 Grok 4.5 Grok 4.5 medium प्रकाशन: 2026-07-08
स्कोअर 8.4 8.3
क्रमांक #25 #28
विश्वसनीयता 9.9 10.0
सुसंगतता 8.9 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 80.3% 78.8%
अस्थिर चाचण्या 3 3
एकूण रन 66 66
प्रति निकाल खर्च 8.173 12.049
एकूण खर्च $1.143 $1.928
इनपुट किंमत $1.040 / 1M $2.000 / 1M
आउटपुट किंमत $6.240 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 79,240 122,146
आउटपुट टोकन्स 5,098 5,514
रिझनिंग टोकन्स 164,842 275,053
प्रतिसाद वेळ (सरासरी) 67.53s 61.71s
प्रतिसाद वेळ (कमाल) 238.07s 436.38s
प्रतिसाद वेळ (एकूण) 1485.64s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Qwen3.6 Max Preview

medium
खर्च
$0.024
वेळ
76.5s
टोकन्स
3,861 tok

#28 xAI: Grok 4.5

medium
खर्च
$0.044
वेळ
59.4s
टोकन्स
7,512 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

झटपट तुलना

तुलना जोडी बदला