नेविगेशन
AI BENCHY
Advertise here

Qwen3.7 Flash (low) vs Grok 4.3 (medium)

Qwen3.7 Flash (low) average score में आगे है: 7.3 vs 7.1. Qwen3.7 Flash (low) की benchmark लागत कम है: $0.042 vs $0.779. Qwen3.7 Flash (low) तेज है: 36.80s vs 47.45s, pass rates 68.2% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#75
कुल आउटपुट टोकन
297,249
प्रतिक्रिया समय (औसत)
36.80s
कुल लागत
$0.042
रैंक
#83
कुल आउटपुट टोकन
241,421
प्रतिक्रिया समय (औसत)
47.45s
कुल लागत
$0.779
अनुशंसित मॉडल Qwen3.7 Flash (low)

It has the best score here (7.3), while costing about 18.8x less than Grok 4.3 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Flash Qwen3.7 Flash low रिलीज़: 2026-07-28 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 7.3 7.1
रैंक #75 #83
विश्वसनीयता 9.9 10.0
संगति 8.4 8.6
सही परीक्षण
प्रति प्रयास पास दर 68.2% 68.2%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 0.346 5.990
कुल लागत $0.042 $0.779
इनपुट कीमत $0.030 / 1M $1.250 / 1M
आउटपुट कीमत $0.130 / 1M $2.500 / 1M
कुल इनपुट टोकन 92,182 140,031
आउटपुट टोकन 14,287 13,739
रीजनिंग टोकन 282,962 227,682
प्रतिक्रिया समय (औसत) 36.80s 47.45s
प्रतिक्रिया समय (अधिकतम) 394.54s 216.69s
प्रतिक्रिया समय (कुल) 809.54s 1043.83s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 Qwen3.7 Flash

low
अमान्य SVG
लागत
$0.000
समय
600.0s
टोकन
0 tok

#83 xAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Flash 6.7 7.8 55.6% 1 42.36s 7,893 428 56,419
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

त्वरित तुलना

तुलना जोड़ी बदलें