नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Qwen3.6 Flash

Qwen3.6 Flash average score मध्ये पुढे आहे: 6.1 vs 6.0. Qwen3.6 Flash चा benchmark खर्च कमी आहे: $0.062 vs $0.792. Qwen3.6 Flash वेगवान आहे: 3.74s vs 84.96s, pass rates 45.5% vs 34.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#150
एकूण आउटपुट टोकन्स
1,002,646
प्रतिसाद वेळ (सरासरी)
84.96s
एकूण खर्च
$0.792
क्रमांक
#139
एकूण आउटपुट टोकन्स
30,947
प्रतिसाद वेळ (सरासरी)
3.74s
एकूण खर्च
$0.062
शिफारस केलेले मॉडेल Qwen3.6 Flash

It has the best score here (6.1), while costing about 13.0x less than Trinity Large Thinking (medium).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium प्रकाशन: 2026-07-28 Qwen3.6 Flash Qwen3.6 Flash none प्रकाशन: 2026-04-20
स्कोअर 6.0 6.1
क्रमांक #150 #139
विश्वसनीयता 10.0 10.0
सुसंगतता 7.6 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 45.5% 34.9%
अस्थिर चाचण्या 7 1
एकूण रन 66 66
प्रति निकाल खर्च 11.308 0.935
एकूण खर्च $0.792 $0.062
इनपुट किंमत $0.220 / 1M $0.188 / 1M
आउटपुट किंमत $0.850 / 1M $1.125 / 1M
एकूण इनपुट टोकन्स 118,477 139,788
आउटपुट टोकन्स 148,823 30,947
रिझनिंग टोकन्स 853,823 0
प्रतिसाद वेळ (सरासरी) 84.96s 3.74s
प्रतिसाद वेळ (कमाल) 525.14s 48.79s
प्रतिसाद वेळ (एकूण) 1869.16s 82.38s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
खर्च
$0.016
वेळ
75.9s
टोकन्स
19,401 tok

#139 Qwen3.6 Flash

none
खर्च
$0.005
वेळ
20.1s
टोकन्स
4,211 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0

झटपट तुलना

तुलना जोडी बदला