التنقل
AI BENCHY
Advertise here

النماذج المقارنة

مقارنة benchmark بين Kimi K2.6 (medium) vs Kimi K2.5 (medium) vs GLM 5 (medium) vs Claude Opus 4.7 (medium): يتصدر Claude Opus 4.7 (medium) في النتيجة بقيمة 8.7. يتصدر Kimi K2.5 (medium) في الموثوقية بقيمة 10.0. يمتلك GLM 5 (medium) أقل إجمالي التكلفة عند $0.307. Claude Opus 4.7 (medium) هو الأسرع عند 7.61s.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-28

الترتيب
#78
إجمالي رموز الإخراج
391,540
زمن الاستجابة (المتوسط)
109.98s
إجمالي التكلفة
$0.831
الترتيب
#87
إجمالي رموز الإخراج
227,367
زمن الاستجابة (المتوسط)
99.00s
إجمالي التكلفة
$0.600
الترتيب
#50
إجمالي رموز الإخراج
124,566
زمن الاستجابة (المتوسط)
33.54s
إجمالي التكلفة
$0.307
الترتيب
#20
إجمالي رموز الإخراج
29,990
زمن الاستجابة (المتوسط)
7.61s
إجمالي التكلفة
$1.477
النموذج الموصى به Claude Opus 4.7 (medium)

It has the best score here (8.7), while responding about 10.6x faster than النماذج الأخرى في هذه المقارنة.

مقارنة تفصيلية

المقياس Kimi K2.6 Kimi K2.6 medium الإصدار: 2026-04-20 Kimi K2.5 Kimi K2.5 medium الإصدار: 2026-01-27 GLM 5 GLM 5 medium الإصدار: 2026-02-12 Claude Opus 4.7 Claude Opus 4.7 medium الإصدار: 2026-04-16
النتيجة 7.2 7.0 7.7 8.7
الترتيب #78 #87 #50 #20
الموثوقية 9.4 10.0 10.0 10.0
الاتساق 8.3 7.0 8.1 9.6
اختبارات صحيحة
معدل النجاح لكل محاولة 63.6% 65.2% 78.8% 83.3%
اختبارات غير مستقرة 4 8 4 1
إجمالي مرات التشغيل 66 66 63 66
التكلفة لكل نتيجة 9.821 4.789 1.668 8.201
إجمالي التكلفة $0.831 $0.600 $0.307 $1.477
سعر الإدخال $0.646 / 1M $0.571 / 1M $0.950 / 1M $5.000 / 1M
سعر الإخراج $2.720 / 1M $2.850 / 1M $2.551 / 1M $25.000 / 1M
إجمالي رموز الإدخال 68,902 118,448 35,224 145,252
رموز الإخراج 111,680 62,124 21,570 24,948
رموز الاستدلال 279,860 165,243 102,996 5,042
زمن الاستجابة (المتوسط) 109.98s 99.00s 33.54s 7.61s
زمن الاستجابة (الحد الأقصى) 876.20s 281.00s 99.85s 65.40s
زمن الاستجابة (الإجمالي) 2309.56s 1485.04s 435.99s 159.91s

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 MoonshotAI: Kimi K2.6

medium
التكلفة
$0.013
الوقت
103.4s
الرموز
3,620 tok

#87 MoonshotAI: Kimi K2.5

medium
التكلفة
$0.030
الوقت
58.6s
الرموز
8,683 tok

#50 GLM 5

medium
التكلفة
$0.005
الوقت
20.7s
الرموز
2,068 tok

#20 Claude Opus 4.7

medium
التكلفة
$0.059
الوقت
26.8s
الرموز
2,475 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114

مقارنة سريعة

تبديل زوج المقارنة