नेविगेशन
AI BENCHY
Advertise here

gpt-oss-120b vs Qwen3.6 35B A3B

Qwen3.6 35B A3B average score में आगे है: 5.3 vs 3.7. gpt-oss-120b की benchmark लागत कम है: $0.010 vs $0.061. Qwen3.6 35B A3B तेज है: 5.52s vs 21.61s, pass rates 33.3% vs 31.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#222
कुल आउटपुट टोकन
51,664
प्रतिक्रिया समय (औसत)
21.61s
कुल लागत
$0.010
रैंक
#175
कुल आउटपुट टोकन
46,957
प्रतिक्रिया समय (औसत)
5.52s
कुल लागत
$0.061
अनुशंसित मॉडल Qwen3.6 35B A3B

It has the best score here (5.3), while responding about 3.9x faster than gpt-oss-120b.

विस्तृत तुलना

मेट्रिक gpt-oss-120b gpt-oss-120b none रिलीज़: 2025-08-05 निःशुल्क उपलब्ध Qwen3.6 35B A3B Qwen3.6 35B A3B none रिलीज़: 2026-04-20
स्कोर 3.7 5.3
रैंक #222 #175
विश्वसनीयता 10.0 10.0
संगति 7.8 7.7
सही परीक्षण
प्रति प्रयास पास दर 33.3% 31.8%
अस्थिर टेस्ट 2 6
कुल रन 57 66
प्रति परिणाम लागत 0.168 1.496
कुल लागत $0.010 $0.061
इनपुट कीमत $0.037 / 1M $0.140 / 1M
आउटपुट कीमत $0.170 / 1M $1.000 / 1M
कुल इनपुट टोकन 9,081 93,979
आउटपुट टोकन 51,664 46,957
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 21.61s 5.52s
प्रतिक्रिया समय (अधिकतम) 113.71s 39.54s
प्रतिक्रिया समय (कुल) 345.79s 110.40s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#222 gpt-oss-120b

none
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
$0.000
समय
-
टोकन
0 tok

#175 Qwen3.6 35B A3B

none
लागत
$0.008
समय
30.1s
टोकन
6,317 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
Qwen3.6 35B A3B 5.5 10.0 33.3% 0 8.77s 7,911 11,161 0

त्वरित तुलना

तुलना जोड़ी बदलें