नेविगेशन
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.8 2.4T A95B (low)

Qwen3.8 2.4T A95B (low) average score में आगे है: 8.2 vs 8.0. GPT-5.2 Chat की benchmark लागत कम है: $0.604 vs $3.113. GPT-5.2 Chat तेज है: 7.65s vs 132.39s, pass rates 74.2% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#51
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
रैंक
#46
कुल आउटपुट टोकन
554,485
प्रतिक्रिया समय (औसत)
132.39s
कुल लागत
$3.113
अनुशंसित मॉडल GPT-5.2 Chat

Its score stays close to the best score here (8.0 vs 8.2), while costing about 5.2x less than Qwen3.8 2.4T A95B (low).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low रिलीज़: 2026-08-12
स्कोर 8.0 8.2
रैंक #51 #46
विश्वसनीयता 10.0 9.1
संगति 8.6 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 74.2% 78.8%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 4.308 19.453
कुल लागत $0.604 $3.113
इनपुट कीमत $1.750 / 1M $2.000 / 1M
आउटपुट कीमत $14.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 101,248 113,340
आउटपुट टोकन 30,424 107,311
रीजनिंग टोकन 0 447,174
प्रतिक्रिया समय (औसत) 7.65s 132.39s
प्रतिक्रिया समय (अधिकतम) 38.52s 534.21s
प्रतिक्रिया समय (कुल) 168.39s 2912.56s
पैरामीटर ~400B कुल (~17B सक्रिय) 2.4T कुल (95B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#51 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#46 Qwen3.8 2.4T A95B

low
लागत
$0.100
समय
193.2s
टोकन
16,767 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.8 2.4T A95B 7.6 7.2 77.8% 1 172.53s 6,716 21,405 57,399

त्वरित तुलना

तुलना जोड़ी बदलें