नेविगेशन
Advertise here

GPT-5.4 (medium) vs Qwen3.8 27B (high)

GPT-5.4 (medium) average score में आगे है: 8.8 vs 8.7. Qwen3.8 27B (high) की benchmark लागत कम है: ~$0.298 vs $2.006. GPT-5.4 (medium) तेज है: 24.81s vs 166.34s, pass rates 78.3% vs 78.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#50
कुल आउटपुट टोकन
96,502
प्रतिक्रिया समय (औसत)
24.81s
कुल लागत
$2.006
रैंक
#55
कुल आउटपुट टोकन
677,080
प्रतिक्रिया समय (औसत)
166.34s
कुल लागत
~$0.298
अनुशंसित मॉडल Qwen3.8 27B (high)

Its score stays close to the best score here (8.7 vs 8.8), while costing about 6.7x less than GPT-5.4 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 GPT-5.4 medium रिलीज़: 2026-03-05 Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14 निःशुल्क उपलब्ध
स्कोर 8.8 8.7
रैंक #50 #55
विश्वसनीयता 10.0 9.7
संगति 8.7 9.2
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 78.3% 78.3%
अस्थिर टेस्ट 4 2
कुल रन 69 69
प्रति परिणाम लागत 12.535 ~1.751
कुल लागत $2.006 ~$0.298
इनपुट कीमत $2.500 / 1M लागू नहीं
आउटपुट कीमत $15.000 / 1M लागू नहीं
कुल इनपुट टोकन 223,210 348,967
आउटपुट टोकन 7,312 1,005
रीजनिंग टोकन 89,190 676,075
प्रतिक्रिया समय (औसत) 24.81s 166.34s
प्रतिक्रिया समय (अधिकतम) 100.41s 640.85s
प्रतिक्रिया समय (कुल) 570.60s 3825.81s
पैरामीटर ~1.5T कुल (~100B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 GPT-5.4

medium
लागत
$0.214
समय
199.6s
टोकन
14,349 tok

#55 Qwen3.8 27B

high
लागत
~$0.008
समय
270.1s
टोकन
18,963 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2mediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धQwen3.8 27Bhighनिःशुल्क उपलब्धvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धGPT-6 SollowvsQwen3.8 27Bhighनिःशुल्क उपलब्धGPT-5.4mediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-5.4mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27Bhighनिःशुल्क उपलब्धMuse Spark 1.2lowvsQwen3.8 27Bhighनिःशुल्क उपलब्धMuse Spark 1.2lowvsGPT-5.4mediumDeepSeek V4.1 FlashmediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धMuse Spark 1.1lowvsQwen3.8 27Bhighनिःशुल्क उपलब्धClaude Sonnet 5.5xhighvsQwen3.8 27Bhighनिःशुल्क उपलब्ध