नेविगेशन
Advertise here

GPT-6 Sol vs Qwen3.7 Flash (low)

average score लगभग बराबर है: 7.2 vs 7.2. Qwen3.7 Flash (low) की benchmark लागत कम है: $0.043 vs $0.280. GPT-6 Sol तेज है: 6.84s vs 38.05s, pass rates 66.7% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#148
कुल आउटपुट टोकन
6,696
प्रतिक्रिया समय (औसत)
6.84s
कुल लागत
$0.280
रैंक
#150
कुल आउटपुट टोकन
304,019
प्रतिक्रिया समय (औसत)
38.05s
कुल लागत
$0.043
अनुशंसित मॉडल Qwen3.7 Flash (low)

It has the best score here (7.2), while costing about 6.6x less than GPT-6 Sol.

विस्तृत तुलना

मेट्रिक GPT-6 Sol GPT-6 Sol none रिलीज़: 2026-09-23 Qwen3.7 Flash Qwen3.7 Flash low रिलीज़: 2026-07-28
स्कोर 7.2 7.2
रैंक #148 #150
विश्वसनीयता 10.0 10.0
संगति 8.5 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 66.7% 66.7%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 2.151 0.385
कुल लागत $0.280 $0.043
इनपुट कीमत $2.000 / 1M $0.030 / 1M
आउटपुट कीमत $10.000 / 1M $0.130 / 1M
कुल इनपुट टोकन 106,332 92,191
आउटपुट टोकन 6,696 14,286
रीजनिंग टोकन 0 289,733
प्रतिक्रिया समय (औसत) 6.84s 38.05s
प्रतिक्रिया समय (अधिकतम) 23.89s 394.54s
प्रतिक्रिया समय (कुल) 150.43s 837.05s
पैरामीटर ~2T कुल (~150B सक्रिय) ~35B कुल (~3B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#148 GPT-6 Sol

none
लागत
$0.030
समय
31.9s
टोकन
3,055 tok

#150 Qwen3.7 Flash

low
Reached the allocated time limit (600 seconds) without receiving showcase output.
लागत
$0.000
समय
600.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Sol 5.5 10.0 33.3% 0 12.23s 7,302 389 0
Qwen3.7 Flash 6.7 7.8 55.6% 1 42.36s 7,893 428 56,419

त्वरित तुलना

तुलना जोड़ी बदलें