नेविगेशन
Advertise here

Seed-2.0-Code (low) vs Qwen3.8 27B (medium)

Qwen3.8 27B (medium) average score में आगे है: 7.8 vs 7.7. Qwen3.8 27B (medium) की benchmark लागत कम है: ~$0.058 vs $0.767. Qwen3.8 27B (medium) तेज है: 33.05s vs 72.24s, pass rates 77.3% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#106
कुल आउटपुट टोकन
241,309
प्रतिक्रिया समय (औसत)
72.24s
कुल लागत
$0.767
रैंक
#101
कुल आउटपुट टोकन
136,162
प्रतिक्रिया समय (औसत)
33.05s
कुल लागत
~$0.058
अनुशंसित मॉडल Qwen3.8 27B (medium)

It has the best score here (7.8), while costing about 13.4x less than Seed-2.0-Code (low).

विस्तृत तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code low रिलीज़: 2026-08-12 Qwen3.8 27B Qwen3.8 27B medium रिलीज़: 2026-08-14
स्कोर 7.7 7.8
रैंक #106 #101
विश्वसनीयता 8.5 9.6
संगति 7.8 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 66.7%
अस्थिर टेस्ट 6 1
कुल रन 66 66
प्रति परिणाम लागत 5.899 ~0.409
कुल लागत $0.767 ~$0.058
इनपुट कीमत $0.500 / 1M लागू नहीं
आउटपुट कीमत $3.000 / 1M लागू नहीं
कुल इनपुट टोकन 85,657 98,266
आउटपुट टोकन 8,142 1,861
रीजनिंग टोकन 233,167 134,301
प्रतिक्रिया समय (औसत) 72.24s 33.05s
प्रतिक्रिया समय (अधिकतम) 485.92s 214.63s
प्रतिक्रिया समय (कुल) 1589.31s 694.04s
पैरामीटर ~200B कुल (~20B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Seed-2.0-Code

low
Provider returned error
लागत
$0.000
समय
0.3s
टोकन
0 tok

#101 Qwen3.8 27B

medium
लागत
~$0.002
समय
43.4s
टोकन
2,956 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Code 7.0 7.1 55.6% 1 109.70s 7,948 455 55,759
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

त्वरित तुलना

तुलना जोड़ी बदलें