नेविगेशन
AI BENCHY
Advertise here

GPT-5.5 (medium) vs Qwen3.7 Max (medium)

Qwen3.7 Max (medium) average score में आगे है: 9.1 vs 9.0. Qwen3.7 Max (medium) की benchmark लागत कम है: $1.157 vs $4.163. GPT-5.5 (medium) तेज है: 38.97s vs 44.32s, pass rates 87.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#19
कुल आउटपुट टोकन
125,316
प्रतिक्रिया समय (औसत)
38.97s
कुल लागत
$4.163
रैंक
#17
कुल आउटपुट टोकन
226,102
प्रतिक्रिया समय (औसत)
44.32s
कुल लागत
$1.157
अनुशंसित मॉडल Qwen3.7 Max (medium)

It has the best score here (9.1), while costing about 3.6x less than GPT-5.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24 Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22
स्कोर 9.0 9.1
रैंक #19 #17
विश्वसनीयता 10.0 10.0
संगति 8.9 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 87.9% 86.4%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 23.127 8.904
कुल लागत $4.163 $1.157
इनपुट कीमत $5.000 / 1M $1.475 / 1M
आउटपुट कीमत $30.000 / 1M $4.425 / 1M
कुल इनपुट टोकन 80,668 106,029
आउटपुट टोकन 5,617 5,748
रीजनिंग टोकन 119,699 220,354
प्रतिक्रिया समय (औसत) 38.97s 44.32s
प्रतिक्रिया समय (अधिकतम) 332.10s 556.06s
प्रतिक्रिया समय (कुल) 857.43s 975.11s
पैरामीटर ~1.5T कुल (~100B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

#17 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808

त्वरित तुलना

तुलना जोड़ी बदलें