नेविगेशन
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.5-122B-A10B (medium)

GPT-5.2 Chat average score में आगे है: 8.0 vs 7.1. GPT-5.2 Chat की benchmark लागत कम है: $0.604 vs $1.046. GPT-5.2 Chat तेज है: 7.65s vs 64.16s, pass rates 74.2% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#37
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
रैंक
#82
कुल आउटपुट टोकन
487,218
प्रतिक्रिया समय (औसत)
64.16s
कुल लागत
$1.046
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (8.0), while costing about 1.7x less than Qwen3.5-122B-A10B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium रिलीज़: 2026-02-24
स्कोर 8.0 7.1
रैंक #37 #82
विश्वसनीयता 10.0 10.0
संगति 8.6 8.5
सही परीक्षण
प्रति प्रयास पास दर 74.2% 71.2%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 4.308 8.509
कुल लागत $0.604 $1.046
इनपुट कीमत $1.750 / 1M $0.260 / 1M
आउटपुट कीमत $14.000 / 1M $2.080 / 1M
कुल इनपुट टोकन 101,248 124,771
आउटपुट टोकन 30,424 44,077
रीजनिंग टोकन 0 443,141
प्रतिक्रिया समय (औसत) 7.65s 64.16s
प्रतिक्रिया समय (अधिकतम) 38.52s 519.30s
प्रतिक्रिया समय (कुल) 168.39s 1411.60s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#82 Qwen3.5-122B-A10B

medium
लागत
$0.019
समय
48.7s
टोकन
6,034 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

त्वरित तुलना

तुलना जोड़ी बदलें