नेविगेशन
AI BENCHY
Advertise here

Qwen3.7 Plus (medium) vs Inkling (medium)

Inkling (medium) average score में आगे है: 8.0 vs 7.9. Qwen3.7 Plus (medium) की benchmark लागत कम है: $0.277 vs $0.377. Inkling (medium) तेज है: 15.66s vs 53.51s, pass rates 75.8% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#62
कुल आउटपुट टोकन
187,337
प्रतिक्रिया समय (औसत)
53.51s
कुल लागत
$0.277
रैंक
#56
कुल आउटपुट टोकन
63,842
प्रतिक्रिया समय (औसत)
15.66s
कुल लागत
$0.377
अनुशंसित मॉडल Inkling (medium)

It has the best score here (8.0), while responding about 3.4x faster than Qwen3.7 Plus (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus medium रिलीज़: 2026-06-03 Inkling Inkling medium रिलीज़: 2026-07-18
स्कोर 7.9 8.0
रैंक #62 #56
विश्वसनीयता 10.0 10.0
संगति 8.9 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 75.8% 75.8%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 2.134 2.551
कुल लागत $0.277 $0.377
इनपुट कीमत $0.320 / 1M $0.950 / 1M
आउटपुट कीमत $1.280 / 1M $4.050 / 1M
कुल इनपुट टोकन 115,242 124,062
आउटपुट टोकन 6,163 12,190
रीजनिंग टोकन 181,174 51,652
प्रतिक्रिया समय (औसत) 53.51s 15.66s
प्रतिक्रिया समय (अधिकतम) 315.30s 85.12s
प्रतिक्रिया समय (कुल) 1177.25s 344.52s
पैरामीटर ~397B कुल (~17B सक्रिय) 975B कुल (41B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 Qwen3.7 Plus

medium
लागत
$0.018
समय
193.2s
टोकन
10,821 tok

#56 Thinking Machines: Inkling

medium
लागत
$0.004
समय
11.2s
टोकन
852 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
Inkling 8.4 7.8 77.8% 1 25.20s 7,374 525 14,457

त्वरित तुलना

तुलना जोड़ी बदलें