التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

KAT-Coder-Pro V2.5 (medium) vs GPT-6 Luna (low)

يتقدم GPT-6 Luna (low) في متوسط النتيجة بـ 7.0 مقابل 6.9. لدى GPT-6 Luna (low) تكلفة benchmark أقل عند $0.020 مقابل $0.478. GPT-6 Luna (low) أسرع عند 21.96s مقابل 24.87s، مع معدلات نجاح 65.2% مقابل 62.1%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-09-23

النماذج المقارنة

الترتيب
#167
إجمالي رموز الإخراج
139,375
زمن الاستجابة (المتوسط)
24.87s
إجمالي التكلفة
$0.478
الترتيب
#159
إجمالي رموز الإخراج
22,605
زمن الاستجابة (المتوسط)
21.96s
إجمالي التكلفة
$0.020
النموذج الموصى به GPT-6 Luna (low)

It has the best score here (7.0), while costing about 24.7x less than KAT-Coder-Pro V2.5 (medium).

مقارنة تفصيلية

المقياس KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium الإصدار: 2026-07-14 GPT-6 Luna GPT-6 Luna low الإصدار: 2026-09-23
النتيجة 6.9 7.0
الترتيب #167 #159
الموثوقية 10.0 9.6
الاتساق 7.0 8.5
محاولات 66/66 66/66
اختبارات صحيحة
معدل النجاح لكل محاولة 65.2% 62.1%
اختبارات غير مستقرة 8 4
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 4.342 0.176
إجمالي التكلفة $0.478 $0.020
سعر الإدخال $0.740 / 1M $0.100 / 1M
سعر الإخراج $2.960 / 1M $0.500 / 1M
إجمالي رموز الإدخال 87,916 80,159
رموز الإخراج 7,213 4,623
رموز الاستدلال 132,162 17,982
زمن الاستجابة (المتوسط) 24.87s 21.96s
زمن الاستجابة (الحد الأقصى) 257.00s 89.37s
زمن الاستجابة (الإجمالي) 547.14s 483.19s
المعلمات ~700B الإجمالي (~72B النشطة) ~400B الإجمالي (~17B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 KAT-Coder-Pro V2.5

medium
التكلفة
$0.009
الوقت
25.6s
الرموز
2,939 tok

#159 GPT-6 Luna

low
التكلفة
$0.002
الوقت
19.2s
الرموز
2,598 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

مقارنة سريعة

تبديل زوج المقارنة