नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Qwen3.5-35B-A3B

Qwen3.5-35B-A3B average score मध्ये पुढे आहे: 6.1 vs 6.0. Qwen3.5-35B-A3B चा benchmark खर्च कमी आहे: $0.106 vs $0.792. Qwen3.5-35B-A3B वेगवान आहे: 12.72s vs 84.96s, pass rates 45.5% vs 43.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#150
एकूण आउटपुट टोकन्स
1,002,646
प्रतिसाद वेळ (सरासरी)
84.96s
एकूण खर्च
$0.792
क्रमांक
#142
एकूण आउटपुट टोकन्स
86,614
प्रतिसाद वेळ (सरासरी)
12.72s
एकूण खर्च
$0.106
शिफारस केलेले मॉडेल Qwen3.5-35B-A3B

It has the best score here (6.1), while costing about 7.5x less than Trinity Large Thinking (medium).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium प्रकाशन: 2026-07-28 Qwen3.5-35B-A3B Qwen3.5-35B-A3B none प्रकाशन: 2026-02-24
स्कोअर 6.0 6.1
क्रमांक #150 #142
विश्वसनीयता 10.0 10.0
सुसंगतता 7.6 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 45.5% 43.9%
अस्थिर चाचण्या 7 4
एकूण रन 66 66
प्रति निकाल खर्च 11.308 1.578
एकूण खर्च $0.792 $0.106
इनपुट किंमत $0.220 / 1M $0.140 / 1M
आउटपुट किंमत $0.850 / 1M $1.000 / 1M
एकूण इनपुट टोकन्स 118,477 134,521
आउटपुट टोकन्स 148,823 86,614
रिझनिंग टोकन्स 853,823 0
प्रतिसाद वेळ (सरासरी) 84.96s 12.72s
प्रतिसाद वेळ (कमाल) 525.14s 209.15s
प्रतिसाद वेळ (एकूण) 1869.16s 279.90s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
खर्च
$0.016
वेळ
75.9s
टोकन्स
19,401 tok

#142 Qwen3.5-35B-A3B

none
खर्च
$0.005
वेळ
28.4s
टोकन्स
4,518 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Qwen3.5-35B-A3B 5.5 10.0 33.3% 0 1.39s 7,808 571 0

झटपट तुलना

तुलना जोडी बदला