नेविगेशन
AI BENCHY
Advertise here

GPT-5.5 (low) vs Qwen3.7 Max (medium)

GPT-5.5 (low) average score में आगे है: 9.3 vs 9.1. Qwen3.7 Max (medium) की benchmark लागत कम है: $1.157 vs $1.257. GPT-5.5 (low) तेज है: 10.15s vs 44.32s, pass rates 86.4% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#10
कुल आउटपुट टोकन
28,540
प्रतिक्रिया समय (औसत)
10.15s
कुल लागत
$1.257
रैंक
#17
कुल आउटपुट टोकन
226,102
प्रतिक्रिया समय (औसत)
44.32s
कुल लागत
$1.157
अनुशंसित मॉडल GPT-5.5 (low)

It has the best score here (9.3), while responding about 4.4x faster than Qwen3.7 Max (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24 Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22
स्कोर 9.3 9.1
रैंक #10 #17
विश्वसनीयता 10.0 10.0
संगति 10.0 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 86.4%
अस्थिर टेस्ट 0 3
कुल रन 66 66
प्रति परिणाम लागत 6.614 8.904
कुल लागत $1.257 $1.157
इनपुट कीमत $5.000 / 1M $1.475 / 1M
आउटपुट कीमत $30.000 / 1M $4.425 / 1M
कुल इनपुट टोकन 80,067 106,029
आउटपुट टोकन 5,378 5,748
रीजनिंग टोकन 23,162 220,354
प्रतिक्रिया समय (औसत) 10.15s 44.32s
प्रतिक्रिया समय (अधिकतम) 56.19s 556.06s
प्रतिक्रिया समय (कुल) 223.24s 975.11s
पैरामीटर ~1.5T कुल (~100B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

#17 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808

त्वरित तुलना

तुलना जोड़ी बदलें