नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.5 vs Qwen3.5-35B-A3B (medium)

GPT-5.5 average score में आगे है: 6.9 vs 6.2. GPT-5.5 की benchmark लागत कम है: $0.544 vs $0.837. GPT-5.5 तेज है: 2.36s vs 112.47s, pass rates 56.1% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#98
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.36s
कुल लागत
$0.544
रैंक
#133
कुल आउटपुट टोकन
826,670
प्रतिक्रिया समय (औसत)
112.47s
कुल लागत
$0.837
अनुशंसित मॉडल GPT-5.5

It has the best score here (6.9), while costing about 1.5x less than Qwen3.5-35B-A3B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium रिलीज़: 2026-02-24
स्कोर 6.9 6.2
रैंक #98 #133
विश्वसनीयता 10.0 10.0
संगति 8.9 7.6
सही परीक्षण
प्रति प्रयास पास दर 56.1% 66.7%
अस्थिर टेस्ट 3 6
कुल रन 66 66
प्रति परिणाम लागत 4.945 9.130
कुल लागत $0.544 $0.837
इनपुट कीमत $5.000 / 1M $0.140 / 1M
आउटपुट कीमत $30.000 / 1M $1.000 / 1M
कुल इनपुट टोकन 79,285 130,388
आउटपुट टोकन 4,915 40,630
रीजनिंग टोकन 0 786,040
प्रतिक्रिया समय (औसत) 2.36s 112.47s
प्रतिक्रिया समय (अधिकतम) 12.24s 950.25s
प्रतिक्रिया समय (कुल) 51.88s 2474.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

#133 Qwen3.5-35B-A3B

medium
लागत
$0.009
समय
71.4s
टोकन
8,631 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

त्वरित तुलना

तुलना जोड़ी बदलें