التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 2.5 Flash vs MoonshotAI: Kimi K2.5

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-03

المقياس Google: Gemini 2.5 Flash none الإصدار: 2025-06-17 MoonshotAI: Kimi K2.5 medium الإصدار: 2026-01-27
الترتيب #36 #25
متوسط الدرجة 5.34 6.29
الاتساق 9.40 7.69
التكلفة لكل نتيجة 0.107 2.335
إجمالي التكلفة $0.007 $0.187
اختبارات صحيحة
معدل النجاح لكل محاولة 47.6% 73.8%
اختبارات غير مستقرة 1 4
رموز الإخراج 826 30,504
رموز الاستدلال 0 58,467

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 2.5 Flash 1.00 10.00 0.0% 0 99 0
MoonshotAI: Kimi K2.5 7.00 7.21 88.9% 1 335 6,255
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 2.5 Flash 9.88 10.00 100.0% 0 279 0
MoonshotAI: Kimi K2.5 10.00 10.00 100.0% 0 1,181 6,049
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 2.5 Flash 4.00 7.21 55.6% 1 12 0
MoonshotAI: Kimi K2.5 1.00 4.41 33.3% 2 20,696 30,894
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 2.5 Flash 8.00 9.99 50.0% 0 70 0
MoonshotAI: Kimi K2.5 9.50 10.00 100.0% 0 3,777 4,967
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 2.5 Flash 4.67 10.00 33.3% 0 132 0
MoonshotAI: Kimi K2.5 5.00 7.61 55.6% 1 4,273 9,490
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 2.5 Flash 10.00 10.00 100.0% 0 234 0
MoonshotAI: Kimi K2.5 10.00 10.00 100.0% 0 242 812

مقارنة سريعة

تبديل زوج المقارنة