التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs MoonshotAI: Kimi K2.7 Code

الملخص

مقارنة benchmark بين Gemini 3.1 Flash Lite Preview و Kimi K2.7 Code: يتقدم Kimi K2.7 Code في متوسط النتيجة بـ 7.0 مقابل 6.4. لدى Gemini 3.1 Flash Lite Preview تكلفة benchmark أقل عند $0.018 مقابل $0.583. Gemini 3.1 Flash Lite Preview أسرع عند 1.21s مقابل 83.60s، مع معدلات نجاح 60.3% مقابل 66.7%.

النموذج الموصى به: Gemini 3.1 Flash Lite Preview - Its score stays close to the best score here (6.4 vs 7.0), while costing about 32.9x less than Kimi K2.7 Code.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none الإصدار: 2026-03-03 Kimi K2.7 Code Kimi K2.7 Code medium الإصدار: 2026-06-12
النتيجة 6.4 7.0
الترتيب #84 #65
الموثوقية 10.0 9.2
الاتساق 9.7 7.7
اختبارات صحيحة
معدل النجاح لكل محاولة 60.3% 66.7%
اختبارات غير مستقرة 1 6
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.148 6.074
إجمالي التكلفة $0.018 $0.583
سعر الإدخال $0.250 / 1M $0.740 / 1M
سعر الإخراج $1.500 / 1M $3.500 / 1M
إجمالي رموز الإدخال 37,582 25,991
رموز الإخراج 5,547 80,516
رموز الاستدلال 0 161,391
زمن الاستجابة (المتوسط) 1.21s 83.60s
زمن الاستجابة (الحد الأقصى) 3.39s 365.80s
زمن الاستجابة (الإجمالي) 25.45s 1671.99s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#84 Gemini 3.1 Flash Lite Preview

none
التكلفة
$0.003
الوقت
4.7s
الرموز
1,827 tok

#65 MoonshotAI: Kimi K2.7 Code

medium
التكلفة
$0.025
الوقت
138.0s
الرموز
6,093 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 7.5 8.4 66.7% 1 1.04s 504 1,092 0
Kimi K2.7 Code 7.3 5.8 83.3% 2 11.56s 618 3,048 5,041
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 967ms 8,128 670 0
Kimi K2.7 Code 7.6 7.2 77.8% 1 146.73s 4,650 1,864 25,635
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 3.20s 13,026 339 0
Kimi K2.7 Code 4.7 1.6 66.7% 1 34.83s 11,271 444 3,906
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.22s 7,550 399 0
Kimi K2.7 Code 10.0 10.0 100.0% 0 12.27s 7,014 248 2,569
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 942ms 641 568 0
Kimi K2.7 Code 5.3 7.2 44.4% 1 213.29s 431 55,572 63,639
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 741ms 488 69 0
Kimi K2.7 Code 10.0 10.0 100.0% 0 10.78s 477 1,024 1,071
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.13s 623 574 0
Kimi K2.7 Code 9.9 10.0 100.0% 0 5.39s 669 725 1,232
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 900ms 570 1,045 0
Kimi K2.7 Code 5.9 7.7 44.4% 1 41.00s 651 15,438 17,368
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.39s 5,894 782 0
Kimi K2.7 Code 3.0 10.0 0.0% 0 0ms 0 0 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 814ms 158 9 0
Kimi K2.7 Code 3.0 10.0 0.0% 0 341.76s 210 2,153 40,930

مقارنة سريعة

تبديل زوج المقارنة