नेव्हिगेशन
AI BENCHY
Advertise here

Kimi K2.6 (medium) vs Qwen3.7 Plus

Qwen3.7 Plus average score मध्ये पुढे आहे: 7.3 vs 7.2. Qwen3.7 Plus चा benchmark खर्च कमी आहे: $0.106 vs $1.247. Qwen3.7 Plus वेगवान आहे: 12.11s vs 115.89s, pass rates 63.6% vs 54.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-29

क्रमांक
#107
एकूण आउटपुट टोकन्स
347,519
प्रतिसाद वेळ (सरासरी)
115.89s
एकूण खर्च
$1.247
क्रमांक
#104
एकूण आउटपुट टोकन्स
58,097
प्रतिसाद वेळ (सरासरी)
12.11s
एकूण खर्च
$0.106
शिफारस केलेले मॉडेल Qwen3.7 Plus

It has the best score here (7.3), while costing about 11.8x less than Kimi K2.6 (medium).

तपशीलवार तुलना

मेट्रिक Kimi K2.6 Kimi K2.6 medium प्रकाशन: 2026-04-20 Qwen3.7 Plus Qwen3.7 Plus none प्रकाशन: 2026-06-03
स्कोअर 7.2 7.3
क्रमांक #107 #104
विश्वसनीयता 10.0 10.0
सुसंगतता 8.3 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 54.6%
अस्थिर चाचण्या 4 0
एकूण रन 66 66
प्रति निकाल खर्च 10.029 0.930
एकूण खर्च $1.247 $0.106
इनपुट किंमत $0.950 / 1M $0.320 / 1M
आउटपुट किंमत $4.000 / 1M $1.280 / 1M
एकूण इनपुट टोकन्स 68,913 98,833
आउटपुट टोकन्स 64,654 58,097
रिझनिंग टोकन्स 282,865 0
प्रतिसाद वेळ (सरासरी) 115.89s 12.11s
प्रतिसाद वेळ (कमाल) 876.20s 206.03s
प्रतिसाद वेळ (एकूण) 2433.66s 266.40s
पॅरामीटर्स 1T एकूण (32B सक्रिय) ~397B एकूण (~17B सक्रिय)
उपलब्धता वेट्स उपलब्ध बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 MoonshotAI: Kimi K2.6

medium
खर्च
$0.013
वेळ
103.4s
टोकन्स
3,620 tok

#104 Qwen3.7 Plus

none
खर्च
$0.019
वेळ
213.5s
टोकन्स
11,960 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

झटपट तुलना

तुलना जोडी बदला