नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (low) vs Qwen3.5-35B-A3B

average score लगभग बराबर है: 6.0 vs 6.1. Qwen3.5-35B-A3B की benchmark लागत कम है: $0.106 vs $0.656. Qwen3.5-35B-A3B तेज है: 12.72s vs 96.78s, pass rates 48.5% vs 43.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#145
कुल आउटपुट टोकन
815,220
प्रतिक्रिया समय (औसत)
96.78s
कुल लागत
$0.656
रैंक
#142
कुल आउटपुट टोकन
86,614
प्रतिक्रिया समय (औसत)
12.72s
कुल लागत
$0.106
अनुशंसित मॉडल Qwen3.5-35B-A3B

It has the best score here (6.1), while costing about 6.2x less than Trinity Large Thinking (low).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low रिलीज़: 2026-07-28 Qwen3.5-35B-A3B Qwen3.5-35B-A3B none रिलीज़: 2026-02-24
स्कोर 6.0 6.1
रैंक #145 #142
विश्वसनीयता 9.7 10.0
संगति 7.9 8.6
सही परीक्षण
प्रति प्रयास पास दर 48.5% 43.9%
अस्थिर टेस्ट 6 4
कुल रन 66 66
प्रति परिणाम लागत 8.199 1.578
कुल लागत $0.656 $0.106
इनपुट कीमत $0.220 / 1M $0.140 / 1M
आउटपुट कीमत $0.850 / 1M $1.000 / 1M
कुल इनपुट टोकन 122,845 134,521
आउटपुट टोकन 117,704 86,614
रीजनिंग टोकन 697,516 0
प्रतिक्रिया समय (औसत) 96.78s 12.72s
प्रतिक्रिया समय (अधिकतम) 540.96s 209.15s
प्रतिक्रिया समय (कुल) 2129.13s 279.90s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
लागत
$0.021
समय
173.2s
टोकन
24,586 tok

#142 Qwen3.5-35B-A3B

none
लागत
$0.005
समय
28.4s
टोकन
4,518 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Qwen3.5-35B-A3B 5.5 10.0 33.3% 0 1.39s 7,808 571 0

त्वरित तुलना

तुलना जोड़ी बदलें