नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

OpenAI: GPT-5.2 Chat vs Qwen: Qwen3.5-122B-A10B

सारांश

GPT-5.2 Chat average score में आगे है: 8.5 vs 7.7. GPT-5.2 Chat की benchmark लागत कम है: $0.393 vs $0.588. GPT-5.2 Chat तेज है: 7.13s vs 42.49s, pass rates 74.6% vs 73.0%.

अनुशंसित मॉडलGPT-5.2 ChatIt has the best score here (8.5), while responding about 6.0x faster than Qwen3.5-122B-A10B (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-14

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium रिलीज़: 2026-02-24
स्कोर 8.5 7.7
रैंक #22 #46
विश्वसनीयता 10.0 10.0
संगति 8.9 8.8
सही परीक्षण
प्रति प्रयास पास दर 74.6% 73.0%
अस्थिर टेस्ट 3 3
कुल रन 63 63
प्रति परिणाम लागत 2.803 5.235
कुल लागत $0.393 $0.588
इनपुट कीमत $1.750 / 1M $0.260 / 1M
आउटपुट कीमत $14.000 / 1M $2.080 / 1M
कुल इनपुट टोकन 34,212 41,832
आउटपुट टोकन 23,744 26,187
रीजनिंग टोकन 0 251,028
प्रतिक्रिया समय (औसत) 7.13s 42.49s
प्रतिक्रिया समय (अधिकतम) 38.52s 168.16s
प्रतिक्रिया समय (कुल) 149.69s 892.30s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#46 Qwen3.5-122B-A10B

medium
लागत
$0.019
समय
48.7s
टोकन
6,034 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

त्वरित तुलना

तुलना जोड़ी बदलें