नेविगेशन
AI BENCHY
Advertise here

Trinity Large Preview vs Kwaipilot: KAT-Coder-Air V2.5

KAT-Coder-Air V2.5 (medium) average score में आगे है: 5.6 vs 4.8. Trinity Large Preview की benchmark लागत कम है: $0.008 vs $0.048. Trinity Large Preview तेज है: 2.98s vs 8.42s, pass rates 21.2% vs 45.5%.

अनुशंसित मॉडलKAT-Coder-Air V2.5 (medium)It has the strongest score in this comparison (5.6) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-18

मेट्रिक Trinity Large Preview Trinity Large Preview none रिलीज़: 2026-01-27 KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium रिलीज़: 2026-07-14
स्कोर 4.8 5.6
रैंक #179 #145
विश्वसनीयता 10.0 9.9
संगति 8.9 8.9
सही परीक्षण
प्रति प्रयास पास दर 21.2% 45.5%
अस्थिर टेस्ट 2 3
कुल रन 63 66
प्रति परिणाम लागत 0.017 0.593
कुल लागत $0.008 $0.048
इनपुट कीमत $0.243 / 1M $0.150 / 1M
आउटपुट कीमत $0.243 / 1M $0.600 / 1M
कुल इनपुट टोकन 29,828 51,472
आउटपुट टोकन 2,169 7,822
रीजनिंग टोकन 0 58,352
प्रतिक्रिया समय (औसत) 2.98s 8.42s
प्रतिक्रिया समय (अधिकतम) 14.34s 48.19s
प्रतिक्रिया समय (कुल) 56.57s 185.24s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#179 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
लागत
$0.000
समय
0.0s
टोकन
0 tok

#145 KAT-Coder-Air V2.5

medium
लागत
$0.003
समय
23.7s
टोकन
4,924 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973

त्वरित तुलना

तुलना जोड़ी बदलें