नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Preview vs Qwen: Qwen3.5-9B

Trinity Large Preview average score मध्ये पुढे आहे: 4.8 vs 3.8. Trinity Large Preview चा benchmark खर्च कमी आहे: $0.008 vs $0.036. Trinity Large Preview वेगवान आहे: 2.98s vs 82.24s, pass rates 21.2% vs 25.8%.

शिफारस केलेले मॉडेलTrinity Large PreviewIt has the best score here (4.8), while costing about 4.6x less than Qwen3.5-9B (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक Trinity Large Preview Trinity Large Preview none प्रकाशन: 2026-01-27 Qwen3.5-9B Qwen3.5-9B medium प्रकाशन: 2026-03-02
स्कोअर 4.8 3.8
क्रमांक #192 #214
विश्वसनीयता 10.0 5.0
सुसंगतता 8.9 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 21.2% 25.8%
अस्थिर चाचण्या 2 5
एकूण रन 63 66
प्रति निकाल खर्च 0.017 1.187
एकूण खर्च $0.008 $0.036
इनपुट किंमत $0.243 / 1M $0.100 / 1M
आउटपुट किंमत $0.243 / 1M $0.150 / 1M
एकूण इनपुट टोकन्स 29,828 17,070
आउटपुट टोकन्स 2,169 29,045
रिझनिंग टोकन्स 0 209,516
प्रतिसाद वेळ (सरासरी) 2.98s 82.24s
प्रतिसाद वेळ (कमाल) 14.34s 226.38s
प्रतिसाद वेळ (एकूण) 56.57s 1315.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#192 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
खर्च
$0.000
वेळ
0.0s
टोकन्स
0 tok

#214 Qwen3.5-9B

medium
खर्च
$0.001
वेळ
35.9s
टोकन्स
3,030 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

झटपट तुलना

तुलना जोडी बदला