नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol vs Qwen3.7 Flash (medium)

average score लगभग बराबर है: 6.9 vs 7.0. Qwen3.7 Flash (medium) की benchmark लागत कम है: $0.064 vs $0.524. GPT-5.6 Sol तेज है: 2.16s vs 45.90s, pass rates 59.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#94
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.16s
कुल लागत
$0.524
रैंक
#91
कुल आउटपुट टोकन
462,623
प्रतिक्रिया समय (औसत)
45.90s
कुल लागत
$0.064
अनुशंसित मॉडल Qwen3.7 Flash (medium)

It has the best score here (7.0), while costing about 8.2x less than GPT-5.6 Sol.

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09 Qwen3.7 Flash Qwen3.7 Flash medium रिलीज़: 2026-07-28
स्कोर 6.9 7.0
रैंक #94 #91
विश्वसनीयता 10.0 10.0
संगति 9.0 7.5
सही परीक्षण
प्रति प्रयास पास दर 59.1% 65.2%
अस्थिर टेस्ट 3 7
कुल रन 66 66
प्रति परिणाम लागत 4.761 0.636
कुल लागत $0.524 $0.064
इनपुट कीमत $5.000 / 1M $0.030 / 1M
आउटपुट कीमत $30.000 / 1M $0.130 / 1M
कुल इनपुट टोकन 78,593 114,468
आउटपुट टोकन 4,357 12,786
रीजनिंग टोकन 0 449,837
प्रतिक्रिया समय (औसत) 2.16s 45.90s
प्रतिक्रिया समय (अधिकतम) 12.81s 593.64s
प्रतिक्रिया समय (कुल) 47.62s 1009.84s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

#91 Qwen3.7 Flash

medium
अमान्य SVG
लागत
$0.000
समय
600.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Qwen3.7 Flash 6.2 6.9 55.6% 1 46.78s 7,893 563 61,902

त्वरित तुलना

तुलना जोड़ी बदलें