নেভিগেশন
Advertise here

GPT-5.2 Chat vs MiMo-V2.5 (medium)

average score প্রায় সমান: 7.0 vs 7.1. MiMo-V2.5 (medium)-এর benchmark খরচ কম: $0.419 vs $0.594. GPT-5.2 Chat দ্রুত: 7.43s vs 49.20s, pass rates 66.7% vs 69.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#153
মোট আউটপুট টোকেন
29,742
প্রতিক্রিয়া সময় (গড়)
7.43s
মোট খরচ
$0.594
র‍্যাঙ্ক
#152
মোট আউটপুট টোকেন
341,511
প্রতিক্রিয়া সময় (গড়)
49.20s
মোট খরচ
$0.419
প্রস্তাবিত মডেল GPT-5.2 Chat

It has the best score here (7.0), while responding about 6.6x faster than MiMo-V2.5 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11 MiMo-V2.5 MiMo-V2.5 medium প্রকাশ: 2026-04-22
স্কোর 7.0 7.1
র‍্যাঙ্ক #153 #152
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.7 7.6
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 69.6%
অস্থির টেস্ট 4 7
মোট রান 69 69
প্রতি ফলাফলে খরচ 4.564 3.491
মোট খরচ $0.594 $0.419
ইনপুট মূল্য $1.750 / 1M $0.140 / 1M
আউটপুট মূল্য $14.000 / 1M $0.280 / 1M
মোট ইনপুট টোকেন 101,104 259,664
আউটপুট টোকেন 29,742 8,414
রিজনিং টোকেন 0 333,097
প্রতিক্রিয়া সময় (গড়) 7.43s 49.20s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 38.52s 316.27s
প্রতিক্রিয়া সময় (মোট) 163.35s 1131.69s
প্যারামিটার ~400B মোট (~17B সক্রিয়) 310B মোট (15B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#153 GPT-5.2 Chat

none
খরচ
$0.010
সময়
15.3s
টোকেন
797 tok

#152 MiMo-V2.5

medium
খরচ
$0.002
সময়
54.8s
টোকেন
5,247 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

দ্রুত তুলনা

তুলনার জুটি বদলান