नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 Max — low बनाम medium

medium average score में आगे है: 9.1 vs 8.7. low की benchmark लागत कम है: $0.687 vs $0.728. low तेज है: 21.19s vs 21.53s, pass rates 84.9% vs 84.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-04

रैंक
#23
कुल आउटपुट टोकन
81,411
प्रतिक्रिया समय (औसत)
21.19s
कुल लागत
$0.687
रैंक
#14
कुल आउटपुट टोकन
84,826
प्रतिक्रिया समय (औसत)
21.53s
कुल लागत
$0.728
अनुशंसित मॉडल medium

It has the strongest score in this comparison (9.1) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Qwen3.8 Max Qwen3.8 Max low रिलीज़: 2026-08-04 Qwen3.8 Max Qwen3.8 Max medium रिलीज़: 2026-08-04
स्कोर 8.7 9.1
रैंक #23 #14
विश्वसनीयता 10.0 10.0
संगति 9.0 9.7
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 84.9% 84.9%
अस्थिर टेस्ट 3 1
कुल रन 66 66
प्रति परिणाम लागत 4.041 4.040
कुल लागत $0.687 $0.728
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $6.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 99,172 109,046
आउटपुट टोकन 6,132 6,567
रीजनिंग टोकन 75,279 78,259
प्रतिक्रिया समय (औसत) 21.19s 21.53s
प्रतिक्रिया समय (अधिकतम) 155.75s 126.60s
प्रतिक्रिया समय (कुल) 466.14s 473.75s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Qwen3.8 Max

low
लागत
$0.026
समय
68.5s
टोकन
4,280 tok

#14 Qwen3.8 Max

medium
लागत
$0.028
समय
71.9s
टोकन
4,750 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952
Qwen3.8 Max 10.0 10.0 100.0% 0 41.35s 7,893 430 23,804

त्वरित तुलना

तुलना जोड़ी बदलें