नेविगेशन
Advertise here

GPT-5.2 Chat vs MiMo-V2.5 (medium)

average score लगभग बराबर है: 7.0 vs 7.1. MiMo-V2.5 (medium) की benchmark लागत कम है: $0.419 vs $0.594. GPT-5.2 Chat तेज है: 7.43s vs 49.20s, pass rates 66.7% vs 69.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#153
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.594
रैंक
#152
कुल आउटपुट टोकन
341,511
प्रतिक्रिया समय (औसत)
49.20s
कुल लागत
$0.419
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (7.0), while responding about 6.6x faster than MiMo-V2.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 7.0 7.1
रैंक #153 #152
विश्वसनीयता 10.0 10.0
संगति 8.7 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 66.7% 69.6%
अस्थिर टेस्ट 4 7
कुल रन 69 69
प्रति परिणाम लागत 4.564 3.491
कुल लागत $0.594 $0.419
इनपुट कीमत $1.750 / 1M $0.140 / 1M
आउटपुट कीमत $14.000 / 1M $0.280 / 1M
कुल इनपुट टोकन 101,104 259,664
आउटपुट टोकन 29,742 8,414
रीजनिंग टोकन 0 333,097
प्रतिक्रिया समय (औसत) 7.43s 49.20s
प्रतिक्रिया समय (अधिकतम) 38.52s 316.27s
प्रतिक्रिया समय (कुल) 163.35s 1131.69s
पैरामीटर ~400B कुल (~17B सक्रिय) 310B कुल (15B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#153 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#152 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

त्वरित तुलना

तुलना जोड़ी बदलें