नेविगेशन
Advertise here

GPT-5.5 vs Qwen3.7 Flash (medium)

GPT-5.5 average score में आगे है: 7.0 vs 6.9. Qwen3.7 Flash (medium) की benchmark लागत कम है: $0.065 vs $0.544. GPT-5.5 तेज है: 2.35s vs 47.38s, pass rates 59.1% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#143
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
रैंक
#150
कुल आउटपुट टोकन
470,076
प्रतिक्रिया समय (औसत)
47.38s
कुल लागत
$0.065
अनुशंसित मॉडल Qwen3.7 Flash (medium)

Its score stays close to the best score here (6.9 vs 7.0), while costing about 8.4x less than GPT-5.5.

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24 Qwen3.7 Flash Qwen3.7 Flash medium रिलीज़: 2026-07-28
स्कोर 7.0 6.9
रैंक #143 #150
विश्वसनीयता 10.0 10.0
संगति 9.2 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 59.1% 63.6%
अस्थिर टेस्ट 2 7
कुल रन 66 66
प्रति परिणाम लागत 4.533 0.646
कुल लागत $0.544 $0.065
इनपुट कीमत $5.000 / 1M $0.030 / 1M
आउटपुट कीमत $30.000 / 1M $0.130 / 1M
कुल इनपुट टोकन 79,294 114,477
आउटपुट टोकन 4,915 12,786
रीजनिंग टोकन 0 457,290
प्रतिक्रिया समय (औसत) 2.35s 47.38s
प्रतिक्रिया समय (अधिकतम) 12.24s 593.64s
प्रतिक्रिया समय (कुल) 51.78s 1042.43s
पैरामीटर ~1.5T कुल (~100B सक्रिय) ~35B कुल (~3B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#143 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

#150 Qwen3.7 Flash

medium
Reached the allocated time limit (600 seconds) without receiving showcase output.
लागत
$0.000
समय
600.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.7 Flash 6.2 6.9 55.6% 1 46.78s 7,893 563 61,902

त्वरित तुलना

तुलना जोड़ी बदलें