التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.4 Nano

الملخص

مقارنة benchmark بين Kimi K2.5 و GPT-5.4 Nano: متوسط النتيجة متقارب جدًا عند 7.5 مقابل 7.5. لدى GPT-5.4 Nano تكلفة benchmark أقل عند $0.107 مقابل $0.328. GPT-5.4 Nano أسرع عند 11.95s مقابل 98.43s، مع معدلات نجاح 68.3% مقابل 63.5%.

النموذج الموصى به: GPT-5.4 Nano - It has the best score here (7.5), while costing about 3.1x less than Kimi K2.5.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-12

المقياس Kimi K2.5 Kimi K2.5 medium الإصدار: 2026-01-27 GPT-5.4 Nano GPT-5.4 Nano medium الإصدار: 2026-03-17
النتيجة 7.5 7.5
الترتيب #45 #48
الموثوقية 10.0 10.0
الاتساق 6.9 8.4
اختبارات صحيحة
معدل النجاح لكل محاولة 68.3% 63.5%
اختبارات غير مستقرة 8 4
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 3.704 0.969
إجمالي التكلفة $0.328 $0.107
سعر الإدخال $0.400 / 1M $0.200 / 1M
سعر الإخراج $1.900 / 1M $1.250 / 1M
إجمالي رموز الإدخال 34,312 35,434
رموز الإخراج 48,379 3,014
رموز الاستدلال 157,747 76,520
زمن الاستجابة (المتوسط) 98.43s 11.95s
زمن الاستجابة (الحد الأقصى) 281.00s 94.06s
زمن الاستجابة (الإجمالي) 1378.03s 250.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#45 MoonshotAI: Kimi K2.5

medium
Cost
$0.030
Time
58.6s
Tokens
8,683 tok

#48 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

مقارنة سريعة

تبديل زوج المقارنة