नेविगेशन
AI BENCHY
Advertise here

GPT-5.3 Chat vs MiMo-V2.5 (medium)

GPT-5.3 Chat average score में आगे है: 7.5 vs 6.5. MiMo-V2.5 (medium) की benchmark लागत कम है: $0.082 vs $0.571. GPT-5.3 Chat तेज है: 6.88s vs 32.20s, pass rates 68.2% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#62
कुल आउटपुट टोकन
30,854
प्रतिक्रिया समय (औसत)
6.88s
कुल लागत
$0.571
रैंक
#111
कुल आउटपुट टोकन
237,802
प्रतिक्रिया समय (औसत)
32.20s
कुल लागत
$0.082
अनुशंसित मॉडल GPT-5.3 Chat

It has the best score here (7.5), while responding about 4.7x faster than MiMo-V2.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 7.5 6.5
रैंक #62 #111
विश्वसनीयता 10.0 10.0
संगति 8.2 7.9
सही परीक्षण
प्रति प्रयास पास दर 68.2% 69.7%
अस्थिर टेस्ट 5 6
कुल रन 66 66
प्रति परिणाम लागत 4.387 3.124
कुल लागत $0.571 $0.082
इनपुट कीमत $1.750 / 1M $0.140 / 1M
आउटपुट कीमत $14.000 / 1M $0.280 / 1M
कुल इनपुट टोकन 78,990 105,447
आउटपुट टोकन 30,854 7,120
रीजनिंग टोकन 0 230,682
प्रतिक्रिया समय (औसत) 6.88s 32.20s
प्रतिक्रिया समय (अधिकतम) 18.33s 162.44s
प्रतिक्रिया समय (कुल) 151.31s 708.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

#111 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

त्वरित तुलना

तुलना जोड़ी बदलें