नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Preview vs Qwen: Qwen3.5-9B

Trinity Large Preview average score में आगे है: 4.8 vs 3.8. Trinity Large Preview की benchmark लागत कम है: $0.008 vs $0.036. Trinity Large Preview तेज है: 2.98s vs 82.24s, pass rates 21.2% vs 25.8%.

अनुशंसित मॉडलTrinity Large PreviewIt has the best score here (4.8), while costing about 4.6x less than Qwen3.5-9B (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक Trinity Large Preview Trinity Large Preview none रिलीज़: 2026-01-27 Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02
स्कोर 4.8 3.8
रैंक #192 #214
विश्वसनीयता 10.0 5.0
संगति 8.9 8.1
सही परीक्षण
प्रति प्रयास पास दर 21.2% 25.8%
अस्थिर टेस्ट 2 5
कुल रन 63 66
प्रति परिणाम लागत 0.017 1.187
कुल लागत $0.008 $0.036
इनपुट कीमत $0.243 / 1M $0.100 / 1M
आउटपुट कीमत $0.243 / 1M $0.150 / 1M
कुल इनपुट टोकन 29,828 17,070
आउटपुट टोकन 2,169 29,045
रीजनिंग टोकन 0 209,516
प्रतिक्रिया समय (औसत) 2.98s 82.24s
प्रतिक्रिया समय (अधिकतम) 14.34s 226.38s
प्रतिक्रिया समय (कुल) 56.57s 1315.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#192 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
लागत
$0.000
समय
0.0s
टोकन
0 tok

#214 Qwen3.5-9B

medium
लागत
$0.001
समय
35.9s
टोकन
3,030 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

त्वरित तुलना

तुलना जोड़ी बदलें