नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 (low) vs Qwen3.7 Plus

average score लगभग बराबर है: 7.3 vs 7.3. Qwen3.7 Plus की benchmark लागत कम है: $0.106 vs $0.400. Qwen3.7 Plus तेज है: 12.11s vs 20.20s, pass rates 68.2% vs 54.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-14

रैंक
#96
कुल आउटपुट टोकन
113,193
प्रतिक्रिया समय (औसत)
20.20s
कुल लागत
$0.400
रैंक
#98
कुल आउटपुट टोकन
58,097
प्रतिक्रिया समय (औसत)
12.11s
कुल लागत
$0.106
अनुशंसित मॉडल Qwen3.7 Plus

It has the best score here (7.3), while costing about 3.8x less than KAT-Coder-Pro V2.5 (low).

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low रिलीज़: 2026-07-14 Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03
स्कोर 7.3 7.3
रैंक #96 #98
विश्वसनीयता 10.0 10.0
संगति 7.0 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 54.6%
अस्थिर टेस्ट 8 0
कुल रन 66 66
प्रति परिणाम लागत 3.636 0.930
कुल लागत $0.400 $0.106
इनपुट कीमत $0.740 / 1M $0.320 / 1M
आउटपुट कीमत $2.960 / 1M $1.280 / 1M
कुल इनपुट टोकन 87,682 98,833
आउटपुट टोकन 7,166 58,097
रीजनिंग टोकन 106,027 0
प्रतिक्रिया समय (औसत) 20.20s 12.11s
प्रतिक्रिया समय (अधिकतम) 209.15s 206.03s
प्रतिक्रिया समय (कुल) 444.35s 266.40s
पैरामीटर ~700B कुल (~72B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 KAT-Coder-Pro V2.5

low
लागत
$0.016
समय
47.6s
टोकन
5,182 tok

#98 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

त्वरित तुलना

तुलना जोड़ी बदलें