नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.5 Plus 2026-04-20 (medium) vs Grok 4.3 (medium)

Qwen3.5 Plus 2026-04-20 (medium) average score मध्ये पुढे आहे: 7.2 vs 7.1. Qwen3.5 Plus 2026-04-20 (medium) चा benchmark खर्च कमी आहे: $0.317 vs $0.779. Qwen3.5 Plus 2026-04-20 (medium) वेगवान आहे: 46.36s vs 47.45s, pass rates 63.6% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#78
एकूण आउटपुट टोकन्स
168,893
प्रतिसाद वेळ (सरासरी)
46.36s
एकूण खर्च
$0.317
क्रमांक
#81
एकूण आउटपुट टोकन्स
241,421
प्रतिसाद वेळ (सरासरी)
47.45s
एकूण खर्च
$0.779
शिफारस केलेले मॉडेल Qwen3.5 Plus 2026-04-20 (medium)

It has the best score here (7.2), while costing about 2.5x less than Grok 4.3 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium प्रकाशन: 2026-04-20 Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01
स्कोअर 7.2 7.1
क्रमांक #78 #81
विश्वसनीयता 9.6 10.0
सुसंगतता 9.0 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 68.2%
अस्थिर चाचण्या 2 4
एकूण रन 66 66
प्रति निकाल खर्च 3.023 5.990
एकूण खर्च $0.317 $0.779
इनपुट किंमत $0.300 / 1M $1.250 / 1M
आउटपुट किंमत $1.800 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 42,097 140,031
आउटपुट टोकन्स 2,280 13,739
रिझनिंग टोकन्स 166,613 227,682
प्रतिसाद वेळ (सरासरी) 46.36s 47.45s
प्रतिसाद वेळ (कमाल) 189.38s 216.69s
प्रतिसाद वेळ (एकूण) 973.57s 1043.83s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 Qwen3.5 Plus 2026-04-20

medium
खर्च
$0.008
वेळ
76.7s
टोकन्स
4,355 tok

#81 xAI: Grok 4.3

medium
खर्च
$0.009
वेळ
19.0s
टोकन्स
3,661 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5 Plus 2026-04-20 6.2 8.7 33.3% 0 125.25s 7,630 308 58,682
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

झटपट तुलना

तुलना जोडी बदला