नेव्हिगेशन
AI BENCHY
Advertise here

Qwen: Qwen3.5-9B vs xAI: Grok 4.20

Grok 4.20 average score मध्ये पुढे आहे: 4.1 vs 3.8. Qwen3.5-9B (medium) चा benchmark खर्च कमी आहे: $0.036 vs $0.057. Grok 4.20 वेगवान आहे: 1.11s vs 82.24s, pass rates 25.8% vs 27.3%.

शिफारस केलेले मॉडेलGrok 4.20It has the best score here (4.1), while responding about 74.2x faster than Qwen3.5-9B (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Qwen3.5-9B Qwen3.5-9B medium प्रकाशन: 2026-03-02 Grok 4.20 Grok 4.20 none प्रकाशन: 2026-03-31
स्कोअर 3.8 4.1
क्रमांक #220 #213
विश्वसनीयता 5.0 लागू नाही
सुसंगतता 8.1 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 25.8% 27.3%
अस्थिर चाचण्या 5 0
एकूण रन 66 54
प्रति निकाल खर्च 1.187 1.570
एकूण खर्च $0.036 $0.057
इनपुट किंमत $0.100 / 1M $1.250 / 1M
आउटपुट किंमत $0.150 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 17,070 41,313
आउटपुट टोकन्स 29,045 1,923
रिझनिंग टोकन्स 209,516 0
प्रतिसाद वेळ (सरासरी) 82.24s 1.11s
प्रतिसाद वेळ (कमाल) 226.38s 6.04s
प्रतिसाद वेळ (एकूण) 1315.88s 19.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Qwen3.5-9B

medium
खर्च
$0.001
वेळ
35.9s
टोकन्स
3,030 tok

#213 xAI: Grok 4.20

none
खर्च
$0.004
वेळ
6.5s
टोकन्स
1,367 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

झटपट तुलना

तुलना जोडी बदला