नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Flash (low) vs Grok 4.20 (medium)

Qwen3.7 Flash (low) average score मध्ये पुढे आहे: 7.3 vs 7.1. Qwen3.7 Flash (low) चा benchmark खर्च कमी आहे: $0.042 vs $0.777. Grok 4.20 (medium) वेगवान आहे: 29.47s vs 36.80s, pass rates 68.2% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#80
एकूण आउटपुट टोकन्स
297,249
प्रतिसाद वेळ (सरासरी)
36.80s
एकूण खर्च
$0.042
क्रमांक
#90
एकूण आउटपुट टोकन्स
259,340
प्रतिसाद वेळ (सरासरी)
29.47s
एकूण खर्च
$0.777
शिफारस केलेले मॉडेल Qwen3.7 Flash (low)

It has the best score here (7.3), while costing about 18.8x less than Grok 4.20 (medium).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Flash Qwen3.7 Flash low प्रकाशन: 2026-07-28 Grok 4.20 Grok 4.20 medium प्रकाशन: 2026-03-31
स्कोअर 7.3 7.1
क्रमांक #80 #90
विश्वसनीयता 9.9 10.0
सुसंगतता 8.4 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.2% 63.6%
अस्थिर चाचण्या 5 4
एकूण रन 66 66
प्रति निकाल खर्च 0.346 9.709
एकूण खर्च $0.042 $0.777
इनपुट किंमत $0.030 / 1M $1.250 / 1M
आउटपुट किंमत $0.130 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 92,182 102,791
आउटपुट टोकन्स 14,287 5,363
रिझनिंग टोकन्स 282,962 253,977
प्रतिसाद वेळ (सरासरी) 36.80s 29.47s
प्रतिसाद वेळ (कमाल) 394.54s 199.66s
प्रतिसाद वेळ (एकूण) 809.54s 648.35s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Qwen3.7 Flash

low
अवैध SVG
खर्च
$0.000
वेळ
600.0s
टोकन्स
0 tok

#90 xAI: Grok 4.20

medium
खर्च
$0.041
वेळ
110.3s
टोकन्स
16,336 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Flash 6.7 7.8 55.6% 1 42.36s 7,893 428 56,419
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

झटपट तुलना

तुलना जोडी बदला