नेविगेशन
AI BENCHY
Advertise here

Gemini 3.8 Flash (low) vs Qwen3.7 Max

average score लगभग बराबर है: 7.5 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.239. Qwen3.7 Max तेज है: 4.56s vs 4.83s, pass rates 81.8% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#99
कुल आउटपुट टोकन
41,324
प्रतिक्रिया समय (औसत)
4.83s
कुल लागत
$0.239
रैंक
#101
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.56s
कुल लागत
$0.197
अनुशंसित मॉडल Qwen3.7 Max

It has the strongest score in this comparison (7.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Gemini 3.8 Flash Gemini 3.8 Flash low रिलीज़: 2026-09-02 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 7.5 7.4
रैंक #99 #101
विश्वसनीयता 10.0 9.9
संगति 8.5 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 68.2%
अस्थिर टेस्ट 4 0
कुल रन 66 66
प्रति परिणाम लागत 1.493 1.581
कुल लागत $0.239 $0.197
इनपुट कीमत $0.750 / 1M $1.475 / 1M
आउटपुट कीमत $3.750 / 1M $4.425 / 1M
कुल इनपुट टोकन 111,773 95,992
आउटपुट टोकन 8,035 12,446
रीजनिंग टोकन 33,289 0
प्रतिक्रिया समय (औसत) 4.83s 4.56s
प्रतिक्रिया समय (अधिकतम) 35.14s 72.30s
प्रतिक्रिया समय (कुल) 106.18s 100.30s
पैरामीटर ~500B कुल (~20B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#99 Gemini 3.8 Flash

low
लागत
$0.030
समय
45.8s
टोकन
8,023 tok

#101 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.8 Flash 5.4 7.2 44.4% 1 4.31s 8,118 449 5,706
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें