नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MoonshotAI: Kimi K2.6 vs OpenAI: GPT-5.4 Mini

सारांश

Kimi K2.6 vs GPT-5.4 Mini benchmark तुलना: Kimi K2.6 average score मध्ये पुढे आहे: 5.8 vs 5.3. GPT-5.4 Mini चा benchmark खर्च कमी आहे: $0.038 vs $0.079. GPT-5.4 Mini वेगवान आहे: 1.13s vs 13.27s, pass rates 36.5% vs 30.2%.

शिफारस केलेले मॉडेल: GPT-5.4 Mini - Its score stays close to the best score here (5.3 vs 5.8), while costing about 2.1x less than Kimi K2.6.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-17

मेट्रिक Kimi K2.6 Kimi K2.6 none प्रकाशन: 2026-04-20 मोफत उपलब्ध GPT-5.4 Mini GPT-5.4 Mini none प्रकाशन: 2026-03-17
स्कोअर 5.8 5.3
क्रमांक #110 #123
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 8.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 36.5% 30.2%
अस्थिर चाचण्या 2 3
एकूण रन 63 63
प्रति निकाल खर्च 1.267 0.743
एकूण खर्च $0.079 $0.038
इनपुट किंमत $0.680 / 1M $0.750 / 1M
आउटपुट किंमत $3.410 / 1M $4.500 / 1M
एकूण इनपुट टोकन्स 32,916 34,244
आउटपुट टोकन्स 16,410 2,541
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 13.27s 1.13s
प्रतिसाद वेळ (कमाल) 238.89s 2.52s
प्रतिसाद वेळ (एकूण) 278.57s 23.82s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#110 MoonshotAI: Kimi K2.6

none
Cost
$0.020
Time
127.4s
Tokens
4,429 tok

#123 GPT-5.4 Mini

none
Cost
$0.010
Time
11.7s
Tokens
2,151 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 4.6 10.0 25.0% 0 1.39s 618 471 0
GPT-5.4 Mini 3.1 8.1 8.3% 1 929ms 606 654 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 3.0 10.0 0.0% 0 3.38s 11,269 290 0
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.52s 11,019 298 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 10.0 10.0 100.0% 0 1.32s 7,014 201 0
GPT-5.4 Mini 10.0 10.0 100.0% 0 1.30s 7,140 222 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 5.3 7.2 44.4% 1 1.48s 732 42 0
GPT-5.4 Mini 3.5 4.4 33.3% 2 937ms 723 88 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 5.4 3.5 33.3% 1 1.55s 477 138 0
GPT-5.4 Mini 4.8 10.0 0.0% 0 1.82s 477 174 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 6.5 10.0 50.0% 0 1.64s 669 72 0
GPT-5.4 Mini 6.3 10.0 50.0% 0 728ms 660 101 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 3.1 9.9 0.0% 0 1.40s 651 185 0
GPT-5.4 Mini 5.4 10.0 33.3% 0 836ms 642 305 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 10.0 10.0 100.0% 0 4.46s 5,286 240 0
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.32s 5,477 255 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 3.0 10.0 0.0% 0 1.36s 214 17 0
GPT-5.4 Mini 3.0 10.0 0.0% 0 1.33s 195 43 0

झटपट तुलना

तुलना जोडी बदला