التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs Qwen: Qwen3.6 27B

الملخص

مقارنة benchmark بين Kimi K2.5 و Qwen3.6 27B: يتقدم Kimi K2.5 في متوسط النتيجة بـ 6.8 مقابل 5.6. لدى Qwen3.6 27B تكلفة benchmark أقل عند $0.025 مقابل $0.328. Qwen3.6 27B أسرع عند 3.72s مقابل 98.43s، مع معدلات نجاح 68.3% مقابل 47.6%.

النموذج الموصى به: Qwen3.6 27B - It offers the best overall trade-off: a competitive score (5.6), lower cost than Kimi K2.5, and balanced response time.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-10

المقياس Kimi K2.5 Kimi K2.5 medium الإصدار: 2026-01-27 Qwen3.6 27B Qwen3.6 27B none الإصدار: 2026-04-20
النتيجة 6.8 5.6
الترتيب #77 #119
الموثوقية 10.0 10.0
الاتساق 6.9 7.6
اختبارات صحيحة
معدل النجاح لكل محاولة 68.3% 47.6%
اختبارات غير مستقرة 8 6
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 3.704 0.467
إجمالي التكلفة $0.328 $0.025
سعر الإدخال $0.400 / 1M $0.290 / 1M
سعر الإخراج $1.900 / 1M $2.400 / 1M
إجمالي رموز الإدخال 34,312 52,721
رموز الإخراج 48,379 3,812
رموز الاستدلال 157,747 0
زمن الاستجابة (المتوسط) 98.43s 3.72s
زمن الاستجابة (الحد الأقصى) 281.00s 11.82s
زمن الاستجابة (الإجمالي) 1378.03s 78.08s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#77 MoonshotAI: Kimi K2.5

medium
Cost
$0.030
Time
58.6s
Tokens
8,683 tok

#119 Qwen3.6 27B

none
Cost
$0.009
Time
83.0s
Tokens
4,549 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
Qwen3.6 27B 3.8 3.7 41.7% 3 2.83s 696 490 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
Qwen3.6 27B 3.0 10.0 0.0% 0 9.95s 22,497 1,401 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
Qwen3.6 27B 7.3 5.8 83.3% 1 2.06s 7,788 248 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
Qwen3.6 27B 7.7 10.0 66.7% 0 3.03s 789 24 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
Qwen3.6 27B 5.2 9.9 0.0% 0 1.07s 522 72 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
Qwen3.6 27B 6.2 5.8 66.7% 1 1.92s 711 49 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
Qwen3.6 27B 5.3 7.2 44.4% 1 5.15s 714 639 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
Qwen3.6 27B 9.5 10.0 100.0% 0 6.74s 10,881 339 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644
Qwen3.6 27B 3.0 10.0 0.0% 0 4.03s 210 11 0

مقارنة سريعة

تبديل زوج المقارنة