नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Preview vs Kwaipilot: KAT-Coder-Air V2.5

KAT-Coder-Air V2.5 (medium) average score मध्ये पुढे आहे: 5.6 vs 4.8. Trinity Large Preview चा benchmark खर्च कमी आहे: $0.008 vs $0.048. Trinity Large Preview वेगवान आहे: 2.98s vs 8.42s, pass rates 21.2% vs 45.5%.

शिफारस केलेले मॉडेलKAT-Coder-Air V2.5 (medium)It has the strongest score in this comparison (5.6) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-18

मेट्रिक Trinity Large Preview Trinity Large Preview none प्रकाशन: 2026-01-27 KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium प्रकाशन: 2026-07-14
स्कोअर 4.8 5.6
क्रमांक #179 #145
विश्वसनीयता 10.0 9.9
सुसंगतता 8.9 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 21.2% 45.5%
अस्थिर चाचण्या 2 3
एकूण रन 63 66
प्रति निकाल खर्च 0.017 0.593
एकूण खर्च $0.008 $0.048
इनपुट किंमत $0.243 / 1M $0.150 / 1M
आउटपुट किंमत $0.243 / 1M $0.600 / 1M
एकूण इनपुट टोकन्स 29,828 51,472
आउटपुट टोकन्स 2,169 7,822
रिझनिंग टोकन्स 0 58,352
प्रतिसाद वेळ (सरासरी) 2.98s 8.42s
प्रतिसाद वेळ (कमाल) 14.34s 48.19s
प्रतिसाद वेळ (एकूण) 56.57s 185.24s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#179 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
खर्च
$0.000
वेळ
0.0s
टोकन्स
0 tok

#145 KAT-Coder-Air V2.5

medium
खर्च
$0.003
वेळ
23.7s
टोकन्स
4,924 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973

झटपट तुलना

तुलना जोडी बदला