नेविगेशन
AI BENCHY
Advertise here

Trinity Large Preview vs Kwaipilot: KAT-Coder-Air V2.5

KAT-Coder-Air V2.5 (low) average score में आगे है: 5.4 vs 4.8. Trinity Large Preview की benchmark लागत कम है: $0.008 vs $0.041. Trinity Large Preview तेज है: 2.98s vs 10.09s, pass rates 21.2% vs 45.5%.

अनुशंसित मॉडलKAT-Coder-Air V2.5 (low)It has the strongest score in this comparison (5.4) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-18

मेट्रिक Trinity Large Preview Trinity Large Preview none रिलीज़: 2026-01-27 KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 low रिलीज़: 2026-07-14
स्कोर 4.8 5.4
रैंक #179 #154
विश्वसनीयता 10.0 9.9
संगति 8.9 7.4
सही परीक्षण
प्रति प्रयास पास दर 21.2% 45.5%
अस्थिर टेस्ट 2 7
कुल रन 63 66
प्रति परिणाम लागत 0.017 0.585
कुल लागत $0.008 $0.041
इनपुट कीमत $0.243 / 1M $0.150 / 1M
आउटपुट कीमत $0.243 / 1M $0.600 / 1M
कुल इनपुट टोकन 29,828 61,085
आउटपुट टोकन 2,169 5,905
रीजनिंग टोकन 0 46,990
प्रतिक्रिया समय (औसत) 2.98s 10.09s
प्रतिक्रिया समय (अधिकतम) 14.34s 86.23s
प्रतिक्रिया समय (कुल) 56.57s 222.03s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#179 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
लागत
$0.000
समय
0.0s
टोकन
0 tok

#154 KAT-Coder-Air V2.5

low
लागत
$0.004
समय
29.9s
टोकन
6,008 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
KAT-Coder-Air V2.5 3.5 7.3 11.1% 1 11.06s 7,893 2,001 13,623

त्वरित तुलना

तुलना जोड़ी बदलें