नेविगेशन
AI BENCHY
Advertise here

Qwen3.7 Max (medium) vs Qwen3.8 Max (medium)

average score लगभग बराबर है: 9.2 vs 9.1. Qwen3.8 Max (medium) की benchmark लागत कम है: $0.728 vs $1.116. Qwen3.8 Max (medium) तेज है: 21.53s vs 40.57s, pass rates 87.9% vs 84.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-04

रैंक
#12
कुल आउटपुट टोकन
216,752
प्रतिक्रिया समय (औसत)
40.57s
कुल लागत
$1.116
रैंक
#14
कुल आउटपुट टोकन
84,826
प्रतिक्रिया समय (औसत)
21.53s
कुल लागत
$0.728
अनुशंसित मॉडल Qwen3.8 Max (medium)

It has the best score here (9.1), while costing about 1.5x less than Qwen3.7 Max (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22 Qwen3.8 Max Qwen3.8 Max medium रिलीज़: 2026-08-04
स्कोर 9.2 9.1
रैंक #12 #14
विश्वसनीयता 10.0 10.0
संगति 9.3 9.7
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 87.9% 84.9%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 8.292 4.040
कुल लागत $1.116 $0.728
इनपुट कीमत $1.475 / 1M $2.000 / 1M
आउटपुट कीमत $4.425 / 1M $6.000 / 1M
कुल इनपुट टोकन 106,020 109,046
आउटपुट टोकन 5,748 6,567
रीजनिंग टोकन 211,004 78,259
प्रतिक्रिया समय (औसत) 40.57s 21.53s
प्रतिक्रिया समय (अधिकतम) 556.06s 126.60s
प्रतिक्रिया समय (कुल) 892.57s 473.75s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

#14 Qwen3.8 Max

medium
लागत
$0.028
समय
71.9s
टोकन
4,750 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Qwen3.8 Max 10.0 10.0 100.0% 0 41.35s 7,893 430 23,804

त्वरित तुलना

तुलना जोड़ी बदलें