नेविगेशन
AI BENCHY
Advertise here

Seed 2.1 Turbo (low) vs Qwen3.7 Max (medium)

average score लगभग बराबर है: 9.1 vs 9.2. Qwen3.7 Max (medium) की benchmark लागत कम है: $1.116 vs $1.631. Qwen3.7 Max (medium) तेज है: 40.57s vs 168.41s, pass rates 83.3% vs 87.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#15
कुल आउटपुट टोकन
631,257
प्रतिक्रिया समय (औसत)
168.41s
कुल लागत
$1.631
रैंक
#13
कुल आउटपुट टोकन
216,752
प्रतिक्रिया समय (औसत)
40.57s
कुल लागत
$1.116
अनुशंसित मॉडल Qwen3.7 Max (medium)

It has the best score here (9.2), while responding about 4.2x faster than Seed 2.1 Turbo (low).

विस्तृत तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo low रिलीज़: 2026-08-12 Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22
स्कोर 9.1 9.2
रैंक #15 #13
विश्वसनीयता 9.9 10.0
संगति 8.9 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 87.9%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 9.591 8.292
कुल लागत $1.631 $1.116
इनपुट कीमत $0.500 / 1M $1.475 / 1M
आउटपुट कीमत $2.500 / 1M $4.425 / 1M
कुल इनपुट टोकन 104,483 106,020
आउटपुट टोकन 6,848 5,748
रीजनिंग टोकन 624,409 211,004
प्रतिक्रिया समय (औसत) 168.41s 40.57s
प्रतिक्रिया समय (अधिकतम) 739.98s 556.06s
प्रतिक्रिया समय (कुल) 3705.09s 892.57s
पैरामीटर ~200B कुल (~20B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#15 Seed 2.1 Turbo

low
लागत
$0.049
समय
298.8s
टोकन
19,730 tok

#13 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed 2.1 Turbo 10.0 10.0 100.0% 0 360.85s 8,220 385 207,368
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808

त्वरित तुलना

तुलना जोड़ी बदलें