नेविगेशन
AI BENCHY
Advertise here

GPT-5.5 vs Qwen3.7 Flash (medium)

Qwen3.7 Flash (medium) average score में आगे है: 7.0 vs 6.9. Qwen3.7 Flash (medium) की benchmark लागत कम है: $0.064 vs $0.544. GPT-5.5 तेज है: 2.36s vs 45.90s, pass rates 56.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#98
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.36s
कुल लागत
$0.544
रैंक
#91
कुल आउटपुट टोकन
462,623
प्रतिक्रिया समय (औसत)
45.90s
कुल लागत
$0.064
अनुशंसित मॉडल Qwen3.7 Flash (medium)

It has the best score here (7.0), while costing about 8.6x less than GPT-5.5.

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24 Qwen3.7 Flash Qwen3.7 Flash medium रिलीज़: 2026-07-28
स्कोर 6.9 7.0
रैंक #98 #91
विश्वसनीयता 10.0 10.0
संगति 8.9 7.5
सही परीक्षण
प्रति प्रयास पास दर 56.1% 65.2%
अस्थिर टेस्ट 3 7
कुल रन 66 66
प्रति परिणाम लागत 4.945 0.636
कुल लागत $0.544 $0.064
इनपुट कीमत $5.000 / 1M $0.030 / 1M
आउटपुट कीमत $30.000 / 1M $0.130 / 1M
कुल इनपुट टोकन 79,285 114,468
आउटपुट टोकन 4,915 12,786
रीजनिंग टोकन 0 449,837
प्रतिक्रिया समय (औसत) 2.36s 45.90s
प्रतिक्रिया समय (अधिकतम) 12.24s 593.64s
प्रतिक्रिया समय (कुल) 51.88s 1009.84s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

#91 Qwen3.7 Flash

medium
अमान्य SVG
लागत
$0.000
समय
600.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.7 Flash 6.2 6.9 55.6% 1 46.78s 7,893 563 61,902

त्वरित तुलना

तुलना जोड़ी बदलें