नेव्हिगेशन
AI BENCHY
Advertise here

gpt-oss-120b (medium) vs Qwen3.7 Max

Qwen3.7 Max average score मध्ये पुढे आहे: 7.4 vs 6.1. gpt-oss-120b (medium) चा benchmark खर्च कमी आहे: $0.019 vs $0.197. Qwen3.7 Max वेगवान आहे: 4.52s vs 21.91s, pass rates 50.0% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#132
एकूण आउटपुट टोकन्स
97,816
प्रतिसाद वेळ (सरासरी)
21.91s
एकूण खर्च
$0.019
क्रमांक
#67
एकूण आउटपुट टोकन्स
12,446
प्रतिसाद वेळ (सरासरी)
4.52s
एकूण खर्च
$0.197
शिफारस केलेले मॉडेल Qwen3.7 Max

It has the best score here (7.4), while responding about 4.8x faster than gpt-oss-120b (medium).

तपशीलवार तुलना

मेट्रिक gpt-oss-120b gpt-oss-120b medium प्रकाशन: 2025-08-05 Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22
स्कोअर 6.1 7.4
क्रमांक #132 #67
विश्वसनीयता 10.0 9.9
सुसंगतता 8.0 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 50.0% 68.2%
अस्थिर चाचण्या 5 0
एकूण रन 66 66
प्रति निकाल खर्च 0.221 1.582
एकूण खर्च $0.019 $0.197
इनपुट किंमत $0.037 / 1M $1.475 / 1M
आउटपुट किंमत $0.170 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 108,747 95,983
आउटपुट टोकन्स 29,772 12,446
रिझनिंग टोकन्स 68,044 0
प्रतिसाद वेळ (सरासरी) 21.91s 4.52s
प्रतिसाद वेळ (कमाल) 68.16s 72.30s
प्रतिसाद वेळ (एकूण) 328.70s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 gpt-oss-120b

medium
खर्च
$0.001
वेळ
26.7s
टोकन्स
555 tok

#67 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

झटपट तुलना

तुलना जोडी बदला