- क्रमांक
- #139
- एकूण आउटपुट टोकन्स
- 220,942
- प्रतिसाद वेळ (सरासरी)
- 98.19s
- एकूण खर्च
- $0.479
Kimi K2.5 (medium) vs GPT-5.5
average score जवळपास समान आहे: 7.0 vs 7.0. Kimi K2.5 (medium) चा benchmark खर्च कमी आहे: $0.479 vs $0.544. GPT-5.5 वेगवान आहे: 2.35s vs 98.19s, pass rates 63.6% vs 59.1%.
- क्रमांक
- #135
- एकूण आउटपुट टोकन्स
- 4,915
- प्रतिसाद वेळ (सरासरी)
- 2.35s
- एकूण खर्च
- $0.544
शिफारस केलेले मॉडेल
GPT-5.5
It has the best score here (7.0), while responding about 41.7x faster than Kimi K2.5 (medium).
तपशीलवार तुलना
| मेट्रिक | Kimi K2.5 Kimi K2.5 medium | GPT-5.5 GPT-5.5 none |
|---|---|---|
| स्कोअर | 7.0 | 7.0 |
| क्रमांक | #139 | #135 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 7.0 | 9.2 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 63.6% | 59.1% |
| अस्थिर चाचण्या | 8 | 2 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 4.849 | 4.533 |
| एकूण खर्च | $0.479 | $0.544 |
| इनपुट किंमत | $0.450 / 1M | $5.000 / 1M |
| आउटपुट किंमत | $2.250 / 1M | $30.000 / 1M |
| एकूण इनपुट टोकन्स | 118,496 | 79,294 |
| आउटपुट टोकन्स | 53,522 | 4,915 |
| रिझनिंग टोकन्स | 167,420 | 0 |
| प्रतिसाद वेळ (सरासरी) | 98.19s | 2.35s |
| प्रतिसाद वेळ (कमाल) | 281.00s | 12.24s |
| प्रतिसाद वेळ (एकूण) | 1571.05s | 51.78s |
| पॅरामीटर्स | 1T एकूण (32B सक्रिय) | ~1.5T एकूण (~100B सक्रिय) |
| उपलब्धता | वेट्स उपलब्ध | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#139 MoonshotAI: Kimi K2.5
medium- खर्च
- $0.030
- वेळ
- 58.6s
- टोकन्स
- 8,683 tok
#135 GPT-5.5
none- खर्च
- $0.090
- वेळ
- 54.3s
- टोकन्स
- 3,063 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Mercury 2mediumvsGPT-5.5noneGPT-5.5nonevsGLM 5.1mediumGPT-5.5nonevsGrok 4.20mediumDeepSeek V3.2mediumvsGPT-5.5noneSeed-2.0-MinimediumvsGPT-5.5noneClaude Fable 5.1lowvsKimi K2.5mediumGPT-5.5nonevsGrok 4.3mediumSeed-2.0-CodehighvsKimi K2.5mediumKAT-Coder-Pro V2.5mediumvsGPT-5.5noneKimi K2.5mediumvsGPT-5.6 SolnoneClaude Fable 5.1lowvsGPT-5.5noneGPT-5.5nonevsQwen3.7 Flashmedium