नेव्हिगेशन
AI BENCHY
Advertise here

Qwen3.7 Plus vs Grok 4.6 (low)

Grok 4.6 (low) average score मध्ये पुढे आहे: 7.4 vs 7.3. Qwen3.7 Plus चा benchmark खर्च कमी आहे: $0.106 vs $0.449. Qwen3.7 Plus वेगवान आहे: 12.11s vs 14.55s, pass rates 54.6% vs 69.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-14

क्रमांक
#98
एकूण आउटपुट टोकन्स
58,097
प्रतिसाद वेळ (सरासरी)
12.11s
एकूण खर्च
$0.106
क्रमांक
#93
एकूण आउटपुट टोकन्स
38,048
प्रतिसाद वेळ (सरासरी)
14.55s
एकूण खर्च
$0.449
शिफारस केलेले मॉडेल Qwen3.7 Plus

Its score stays close to the best score here (7.3 vs 7.4), while costing about 4.2x less than Grok 4.6 (low).

तपशीलवार तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none प्रकाशन: 2026-06-03 Grok 4.6 Grok 4.6 low प्रकाशन: 2026-08-12
स्कोअर 7.3 7.4
क्रमांक #98 #93
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 9.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 54.6% 69.7%
अस्थिर चाचण्या 0 1
एकूण रन 66 66
प्रति निकाल खर्च 0.930 2.989
एकूण खर्च $0.106 $0.449
इनपुट किंमत $0.320 / 1M $2.000 / 1M
आउटपुट किंमत $1.280 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 98,833 109,960
आउटपुट टोकन्स 58,097 5,124
रिझनिंग टोकन्स 0 32,924
प्रतिसाद वेळ (सरासरी) 12.11s 14.55s
प्रतिसाद वेळ (कमाल) 206.03s 26.46s
प्रतिसाद वेळ (एकूण) 266.40s 320.17s
पॅरामीटर्स ~397B एकूण (~17B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Qwen3.7 Plus

none
खर्च
$0.019
वेळ
213.5s
टोकन्स
11,960 tok

#93 SpaceXAI: Grok 4.6

low
खर्च
$0.011
वेळ
26.0s
टोकन्स
1,941 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

झटपट तुलना

तुलना जोडी बदला