Advertise here
#85

Qwen3.8 2.4T A95B

Qwen रिलीज़: 2026-08-12 परीक्षण किया गया: 2026-08-12 23:32 qwen/qwen3.8-2.4t-a95b::high
2.4T कुल (95B सक्रिय)MoEवेट उपलब्ध
(high) (low)

सारांश

Qwen3.8 2.4T A95B AI BENCHY पर 7.5 स्कोर करता है और #85 पर है। इसकी reliability 8.8, pass rate 77.3%, कुल लागत $2.755, और औसत response time 134.41s है।

Qwen3.8 2.4T A95B को अलग क्या बनाता है: यह पहेली समाधान में सबसे अलग दिखता है, जहाँ इसकी रैंक #1 है; जबकि कोडिंग इसकी सबसे कमजोर जगह है, जहाँ यह #18 पर है।

मॉडल विवरण

शोध की तारीख: 2026-08-12

घोषित
पैरामीटर
2.4T कुल (95B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
वेट उपलब्ध
लाइसेंस
Apache-2.0

संगति

8.4

कुल आउटपुट टोकन

512,351

कुल इनपुट टोकन

109,036

इनपुट कीमत

$2.000 / 1M

आउटपुट कीमत

$6.000 / 1M

सही परीक्षण

गलत टेस्ट: 7

प्रति प्रयास पास दर: 77.3%

अस्थिर टेस्ट

4

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

134.41s

प्रतिक्रिया समय (अधिकतम): 532.28s

प्रतिक्रिया समय (कुल): 2956.97s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 Qwen3.8 2.4T A95B

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
लागत
$0.000
समय
600.0s
टोकन
0 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-08-14 04:16 दोबारा परीक्षण 7.4 9.4 $2.357 तुलना करें
2026-08-12 23:32 पहला रन 7.5 8.8 $2.755 वर्तमान रन

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-08-12 23:12 $2.000 / 1M $6.000 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 10.0 10.0
कोडिंग 5.9 6.3
संयुक्त 6.9 5.9
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.6 7.2
Samanya Buddhimatta 6.1 3.1
निर्देश पालन 9.8 10.0
पहेली समाधान 10.0 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल