नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 Flash

GPT-5.5 (low) average score में आगे है: 9.3 vs 6.1. Qwen3.6 Flash की benchmark लागत कम है: $0.062 vs $1.253. Qwen3.6 Flash तेज है: 3.74s vs 10.13s, pass rates 86.4% vs 34.9%.

अनुशंसित मॉडलGPT-5.5 (low)It has the strongest score in this comparison (9.3) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24 Qwen3.6 Flash Qwen3.6 Flash none रिलीज़: 2026-04-20
स्कोर 9.3 6.1
रैंक #9 #135
विश्वसनीयता 10.0 10.0
संगति 10.0 9.6
सही परीक्षण
प्रति प्रयास पास दर 86.4% 34.9%
अस्थिर टेस्ट 0 1
कुल रन 66 66
प्रति परिणाम लागत 6.594 0.935
कुल लागत $1.253 $0.062
इनपुट कीमत $5.000 / 1M $0.188 / 1M
आउटपुट कीमत $30.000 / 1M $1.125 / 1M
कुल इनपुट टोकन 80,058 139,788
आउटपुट टोकन 5,378 30,947
रीजनिंग टोकन 23,040 0
प्रतिक्रिया समय (औसत) 10.13s 3.74s
प्रतिक्रिया समय (अधिकतम) 56.19s 48.79s
प्रतिक्रिया समय (कुल) 222.82s 82.38s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

#135 Qwen3.6 Flash

none
लागत
$0.005
समय
20.1s
टोकन
4,211 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0

त्वरित तुलना

तुलना जोड़ी बदलें