AI BENCHY
Advertise here

#65

Qwen3.5-35B-A3B

Qwen रिलीज़: 2026-02-24 परीक्षण किया गया: 2026-05-22 00:15 qwen/qwen3.5-35b-a3b::medium
(medium) (none)

संगति

7.5

कुल लागत (वर्तमान कीमत)

$0.368 ↓ -31.3%

परीक्षण के समय: $0.536

कुल आउटपुट टोकन

361,788

इनपुट कीमत

$0.139 / 1M

आउटपुट कीमत

$1.000 / 1M

सही परीक्षण

गलत टेस्ट: 9

प्रति प्रयास पास दर: 73.3%

अस्थिर टेस्ट

6

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

69.66s

प्रतिक्रिया समय (अधिकतम): 409.98s

प्रतिक्रिया समय (कुल): 1393.17s

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-05-22 00:15 सूट बदला गया 7.0 6.7 $0.547 वर्तमान रन
2026-04-11 01:44 पहला दर्ज रन 7.4 लागू नहीं $0.398 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

रन तुलना

रनस्कोरसंगतिविश्वसनीयतासही परीक्षणअस्थिर टेस्टकुल आउटपुट टोकनकुल लागतप्रतिक्रिया समय (औसत)
2026-05-22 00:15 · वर्तमान रन7.37.510.011/206361,788$0.53669.66s
2026-04-11 01:44 · पहला दर्ज रन7.46.7लागू नहीं10/187218,898$0.39844.51s
अंतर-0.2+0.8+1-1+142890+$0.138+25147ms

इन दो रन में अलग-अलग बेंचमार्क सूट इस्तेमाल हुए थे, इसलिए अंतर मॉडल बदलाव और सूट बदलाव दोनों को दर्शाते हैं।

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-05-28 17:57 $0.139 / 1M $1.000 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 10.0 10.0
कोडिंग 6.5 10.0
संयुक्त 4.7 1.6
डेटा पार्सिंग और निष्कर्षण 7.3 5.9
डोमेन-विशिष्ट 4.1 4.4
Samanya Buddhimatta 2.8 1.6
निर्देश पालन 10.0 10.0
पहेली समाधान 8.2 7.2
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल