नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 (low) vs Qwen3.7 Plus (medium)

Qwen3.7 Plus (medium) average score में आगे है: 7.9 vs 7.4. Qwen3.7 Plus (medium) की benchmark लागत कम है: $0.267 vs $0.387. KAT-Coder-Pro V2.5 (low) तेज है: 19.47s vs 51.51s, pass rates 69.7% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#70
कुल आउटपुट टोकन
108,640
प्रतिक्रिया समय (औसत)
19.47s
कुल लागत
$0.387
रैंक
#43
कुल आउटपुट टोकन
179,429
प्रतिक्रिया समय (औसत)
51.51s
कुल लागत
$0.267
अनुशंसित मॉडल Qwen3.7 Plus (medium)

It has the strongest score in this comparison (7.9) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low रिलीज़: 2026-07-14 Qwen3.7 Plus Qwen3.7 Plus medium रिलीज़: 2026-06-03
स्कोर 7.4 7.9
रैंक #70 #43
विश्वसनीयता 10.0 10.0
संगति 7.0 8.9
सही परीक्षण
प्रति प्रयास पास दर 69.7% 75.8%
अस्थिर टेस्ट 8 3
कुल रन 66 66
प्रति परिणाम लागत 3.514 2.072
कुल लागत $0.387 $0.267
इनपुट कीमत $0.740 / 1M $0.320 / 1M
आउटपुट कीमत $2.960 / 1M $1.280 / 1M
कुल इनपुट टोकन 87,673 115,233
आउटपुट टोकन 7,166 6,162
रीजनिंग टोकन 101,474 173,267
प्रतिक्रिया समय (औसत) 19.47s 51.51s
प्रतिक्रिया समय (अधिकतम) 209.15s 315.30s
प्रतिक्रिया समय (कुल) 428.31s 1133.15s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 KAT-Coder-Pro V2.5

low
लागत
$0.016
समय
47.6s
टोकन
5,182 tok

#43 Qwen3.7 Plus

medium
लागत
$0.018
समय
193.2s
टोकन
10,821 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576

त्वरित तुलना

तुलना जोड़ी बदलें