नेव्हिगेशन
Advertise here

Qwen3.7 Max (medium) vs Pareto

Qwen3.7 Max (medium) average score मध्ये पुढे आहे: 9.1 vs 8.9. Qwen3.7 Max (medium) चा benchmark खर्च कमी आहे: $1.157 vs $1.172. Pareto वेगवान आहे: 31.51s vs 44.32s, pass rates 86.4% vs 86.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-18

तुलना केलेली मॉडेल्स

क्रमांक
#25
एकूण आउटपुट टोकन्स
226,102
प्रतिसाद वेळ (सरासरी)
44.32s
एकूण खर्च
$1.157
क्रमांक
#34
एकूण आउटपुट टोकन्स
119,230
प्रतिसाद वेळ (सरासरी)
31.51s
एकूण खर्च
$1.172
शिफारस केलेले मॉडेल Pareto

It offers the best overall trade-off: a competitive score (8.9), faster response than Qwen3.7 Max (medium), and balanced cost.

तपशीलवार तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max medium प्रकाशन: 2026-05-22 Pareto Pareto none प्रकाशन: 2026-09-18
स्कोअर 9.1 8.9
क्रमांक #25 #34
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 86.4% 86.4%
अस्थिर चाचण्या 3 2
एकूण रन 66 66
प्रति निकाल खर्च 8.904 6.506
एकूण खर्च $1.157 $1.172
इनपुट किंमत $1.475 / 1M $2.500 / 1M
आउटपुट किंमत $4.425 / 1M $7.500 / 1M
एकूण इनपुट टोकन्स 106,029 110,734
आउटपुट टोकन्स 5,748 119,230
रिझनिंग टोकन्स 220,354 0
प्रतिसाद वेळ (सरासरी) 44.32s 31.51s
प्रतिसाद वेळ (कमाल) 556.06s 143.33s
प्रतिसाद वेळ (एकूण) 975.11s 693.29s
पॅरामीटर्स ~1T एकूण (~40B सक्रिय) -
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Qwen3.7 Max

medium
खर्च
$0.017
वेळ
68.8s
टोकन्स
4,526 tok

#34 Pareto

none
खर्च
$0.034
वेळ
170.7s
टोकन्स
4,581 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Pareto 10.0 10.0 100.0% 0 50.12s 7,471 1,949 0

झटपट तुलना

तुलना जोडी बदला