नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (low) vs KAT-Coder-Pro V2.5

Trinity Large Thinking (low) average score मध्ये पुढे आहे: 6.3 vs 6.1. KAT-Coder-Pro V2.5 चा benchmark खर्च कमी आहे: $0.487 vs $0.700. KAT-Coder-Pro V2.5 वेगवान आहे: 24.96s vs 95.16s, pass rates 47.8% vs 68.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#222
एकूण आउटपुट टोकन्स
842,200
प्रतिसाद वेळ (सरासरी)
95.16s
एकूण खर्च
$0.700
क्रमांक
#236
एकूण आउटपुट टोकन्स
139,572
प्रतिसाद वेळ (सरासरी)
24.96s
एकूण खर्च
$0.487
शिफारस केलेले मॉडेल KAT-Coder-Pro V2.5

Its score stays close to the best score here (6.1 vs 6.3), while responding about 3.8x faster than Trinity Large Thinking (low).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low प्रकाशन: 2026-07-28 KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none प्रकाशन: 2026-07-14
स्कोअर 6.3 6.1
क्रमांक #222 #236
विश्वसनीयता 10.0 10.0
सुसंगतता 8.1 7.1
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 47.8% 68.1%
अस्थिर चाचण्या 6 8
एकूण रन 69 69
प्रति निकाल खर्च 9.163 4.419
एकूण खर्च $0.700 $0.487
इनपुट किंमत $0.250 / 1M $0.740 / 1M
आउटपुट किंमत $0.800 / 1M $2.960 / 1M
एकूण इनपुट टोकन्स 347,980 98,508
आउटपुट टोकन्स 121,898 139,572
रिझनिंग टोकन्स 720,302 0
प्रतिसाद वेळ (सरासरी) 95.16s 24.96s
प्रतिसाद वेळ (कमाल) 540.96s 335.41s
प्रतिसाद वेळ (एकूण) 2188.74s 574.12s
पॅरामीटर्स 398B एकूण (13B सक्रिय) ~700B एकूण (~72B सक्रिय)
उपलब्धता वेट्स उपलब्ध बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#222 Trinity Large Thinking

low
खर्च
$0.021
वेळ
173.2s
टोकन्स
24,586 tok

#236 KAT-Coder-Pro V2.5

none
खर्च
$0.010
वेळ
29.0s
टोकन्स
3,439 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0

झटपट तुलना

तुलना जोडी बदला