नेव्हिगेशन
AI BENCHY
Advertise here

तुलना केलेली मॉडेल्स

GLM 5 (medium) vs GLM 5.1 (medium) vs Kimi K2.5 (medium) vs Qwen3.6 Plus Preview (medium) benchmark तुलना: GLM 5 (medium) स्कोअर मध्ये 7.7 सह आघाडीवर आहे. GLM 5 (medium) विश्वसनीयता मध्ये 10.0 सह आघाडीवर आहे. Qwen3.6 Plus Preview (medium) चे एकूण खर्च सर्वात कमी आहे: $0.000. Qwen3.6 Plus Preview (medium) 15.25s वर सर्वात जलद आहे.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#49
एकूण आउटपुट टोकन्स
124,566
प्रतिसाद वेळ (सरासरी)
33.54s
एकूण खर्च
$0.307
क्रमांक
#82
एकूण आउटपुट टोकन्स
152,552
प्रतिसाद वेळ (सरासरी)
46.77s
एकूण खर्च
$0.535
क्रमांक
#85
एकूण आउटपुट टोकन्स
227,367
प्रतिसाद वेळ (सरासरी)
99.00s
एकूण खर्च
$0.600
क्रमांक
#190
एकूण आउटपुट टोकन्स
63,350
प्रतिसाद वेळ (सरासरी)
15.25s
एकूण खर्च
$0.000
शिफारस केलेले मॉडेल GLM 5 (medium)

It has the best score here (7.7), while costing about 1.8x less than या तुलनेतील इतर मॉडेल.

तपशीलवार तुलना

मेट्रिक GLM 5 GLM 5 medium प्रकाशन: 2026-02-12 GLM 5.1 GLM 5.1 medium प्रकाशन: 2026-04-07 Kimi K2.5 Kimi K2.5 medium प्रकाशन: 2026-01-27 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium प्रकाशन: 2026-04-20 मोफत उपलब्ध
स्कोअर 7.7 7.1 7.0 4.9
क्रमांक #49 #82 #85 #190
विश्वसनीयता 10.0 8.3 10.0 लागू नाही
सुसंगतता 8.1 8.4 7.0 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 78.8% 69.7% 65.2% 40.9%
अस्थिर चाचण्या 4 4 8 0
एकूण रन 63 66 66 57
प्रति निकाल खर्च 1.668 4.202 4.789 0.000
एकूण खर्च $0.307 $0.535 $0.600 $0.000
इनपुट किंमत $0.950 / 1M $0.966 / 1M $0.571 / 1M $0.000 / 1M
आउटपुट किंमत $2.551 / 1M $3.036 / 1M $2.850 / 1M $0.000 / 1M
एकूण इनपुट टोकन्स 35,224 82,623 118,448 32,639
आउटपुट टोकन्स 21,570 16,089 62,124 1,153
रिझनिंग टोकन्स 102,996 136,463 165,243 62,197
प्रतिसाद वेळ (सरासरी) 33.54s 46.77s 99.00s 15.25s
प्रतिसाद वेळ (कमाल) 99.85s 308.75s 281.00s 43.55s
प्रतिसाद वेळ (एकूण) 435.99s 982.16s 1485.04s 182.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 GLM 5

medium
खर्च
$0.005
वेळ
20.7s
टोकन्स
2,068 tok

#82 GLM 5.1

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

#85 MoonshotAI: Kimi K2.5

medium
खर्च
$0.030
वेळ
58.6s
टोकन्स
8,683 tok

#190 Qwen3.6 Plus Preview

medium
या मॉडेलसाठी अद्याप कोणताही शोकेस निकाल तयार झालेला नाही.
खर्च
$0.000
वेळ
-
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.6 Plus Preview 9.8 3.3 0.0% 0 0ms 0 0 0

झटपट तुलना

तुलना जोडी बदला