नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

gpt-oss-120b (medium) vs Qwen3.7 Max

Qwen3.7 Max average score में आगे है: 7.4 vs 6.1. gpt-oss-120b (medium) की benchmark लागत कम है: $0.019 vs $0.197. Qwen3.7 Max तेज है: 4.52s vs 21.91s, pass rates 50.0% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#132
कुल आउटपुट टोकन
97,816
प्रतिक्रिया समय (औसत)
21.91s
कुल लागत
$0.019
रैंक
#67
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.52s
कुल लागत
$0.197
अनुशंसित मॉडल Qwen3.7 Max

It has the best score here (7.4), while responding about 4.8x faster than gpt-oss-120b (medium).

विस्तृत तुलना

मेट्रिक gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 6.1 7.4
रैंक #132 #67
विश्वसनीयता 10.0 9.9
संगति 8.0 10.0
सही परीक्षण
प्रति प्रयास पास दर 50.0% 68.2%
अस्थिर टेस्ट 5 0
कुल रन 66 66
प्रति परिणाम लागत 0.221 1.582
कुल लागत $0.019 $0.197
इनपुट कीमत $0.037 / 1M $1.475 / 1M
आउटपुट कीमत $0.170 / 1M $4.425 / 1M
कुल इनपुट टोकन 108,747 95,983
आउटपुट टोकन 29,772 12,446
रीजनिंग टोकन 68,044 0
प्रतिक्रिया समय (औसत) 21.91s 4.52s
प्रतिक्रिया समय (अधिकतम) 68.16s 72.30s
प्रतिक्रिया समय (कुल) 328.70s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 gpt-oss-120b

medium
लागत
$0.001
समय
26.7s
टोकन
555 tok

#67 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें