- الترتيب
- #211
- إجمالي رموز الإخراج
- 17,473
- زمن الاستجابة (المتوسط)
- 8.50s
- إجمالي التكلفة
- $0.104
LongCat 2.0 vs Kimi K2.5 (medium)
متوسط النتيجة متقارب جدًا عند 6.4 مقابل 6.4. لدى LongCat 2.0 تكلفة benchmark أقل عند $0.104 مقابل $0.603. LongCat 2.0 أسرع عند 8.50s مقابل 125.76s، مع معدلات نجاح 42.0% مقابل 60.9%.
النماذج المقارنة
- الترتيب
- #205
- إجمالي رموز الإخراج
- 241,096
- زمن الاستجابة (المتوسط)
- 125.76s
- إجمالي التكلفة
- $0.603
النموذج الموصى به
LongCat 2.0
It has the best score here (6.4), while costing about 5.8x less than Kimi K2.5 (medium).
مقارنة تفصيلية
| المقياس | LongCat 2.0 LongCat 2.0 none | Kimi K2.5 Kimi K2.5 medium |
|---|---|---|
| النتيجة | 6.4 | 6.4 |
| الترتيب | #211 | #205 |
| الموثوقية | 10.0 | 9.6 |
| الاتساق | 9.0 | 7.1 |
| محاولات | 69/69 | 69/69 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 42.0% | 60.9% |
| اختبارات غير مستقرة | 3 | 8 |
| إجمالي مرات التشغيل | 69 | 69 |
| التكلفة لكل نتيجة | 1.298 | 6.085 |
| إجمالي التكلفة | $0.104 | $0.603 |
| سعر الإدخال | $0.300 / 1M | $0.450 / 1M |
| سعر الإخراج | $1.200 / 1M | $2.250 / 1M |
| إجمالي رموز الإدخال | 276,199 | 292,271 |
| رموز الإخراج | 17,473 | 55,025 |
| رموز الاستدلال | 0 | 186,071 |
| زمن الاستجابة (المتوسط) | 8.50s | 125.76s |
| زمن الاستجابة (الحد الأقصى) | 81.77s | 566.79s |
| زمن الاستجابة (الإجمالي) | 195.60s | 2137.84s |
| المعلمات | 1.6T الإجمالي (48B النشطة) | 1T الإجمالي (32B النشطة) |
| الإتاحة | مفتوح المصدر | الأوزان متاحة |
عرض إنشاء النماذج
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#211 LongCat 2.0
none- التكلفة
- $0.027
- الوقت
- 411.7s
- الرموز
- 22,283 tok
#205 MoonshotAI: Kimi K2.5
medium- التكلفة
- $0.030
- الوقت
- 58.6s
- الرموز
- 8,683 tok
أفضل النماذج حسب الدرجة
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
| مهام الوكلاء | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.1 | 3.1 | 66.7% | 1 | 81.77s | 167,447 | 8,098 | 0 | |
| Kimi K2.5 | 3.9 | 9.6 | 0.0% | 0 | 566.79s | 173,775 | 1,503 | 18,651 |
| حيل مضادة للذكاء الاصطناعي | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 4.8 | 10.0 | 25.0% | 0 | 2.87s | 624 | 503 | 0 | |
| Kimi K2.5 | 7.3 | 5.8 | 83.3% | 2 | 51.38s | 634 | 2,789 | 8,880 |
| البرمجة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.5 | 10.0 | 33.3% | 0 | 2.85s | 7,446 | 578 | 0 | |
| Kimi K2.5 | 6.1 | 4.6 | 66.7% | 2 | 217.49s | 6,935 | 5,705 | 74,693 |
| مجمّع | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 28.45s | 83,372 | 7,289 | 0 | |
| Kimi K2.5 | 6.7 | 9.1 | 50.0% | 0 | 89.19s | 95,416 | 14,448 | 11,209 |
| تحليل البيانات واستخراجها | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 2.36s | 7,671 | 246 | 0 | |
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 49.78s | 7,020 | 563 | 7,940 |
| خاص بالمجال | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.3 | 10.0 | 33.3% | 0 | 1.68s | 738 | 28 | 0 | |
| Kimi K2.5 | 2.9 | 4.4 | 22.2% | 2 | 111.65s | 533 | 12,151 | 32,741 |
| الذكاء العام | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.0 | 10.0 | 0.0% | 0 | 2.76s | 489 | 111 | 0 | |
| Kimi K2.5 | 6.5 | 3.4 | 66.7% | 1 | 69.73s | 480 | 3,815 | 4,262 |
| اتباع التعليمات | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 2.82s | 675 | 66 | 0 | |
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 92.47s | 675 | 5,371 | 6,547 |
| حل الألغاز | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 4.0 | 5.0 | 33.3% | 2 | 2.74s | 663 | 299 | 0 | |
| Kimi K2.5 | 5.3 | 7.3 | 44.4% | 1 | 43.23s | 659 | 8,426 | 12,692 |
| استدعاء الأدوات | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 6.64s | 6,867 | 231 | 0 | |
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 31.74s | 5,933 | 242 | 812 |
| معلومات عامة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 3.92s | 207 | 24 | 0 | |
| Kimi K2.5 | 3.0 | 10.0 | 0.0% | 0 | 83.95s | 211 | 12 | 7,644 |
مقارنة سريعة
تبديل زوج المقارنة
LongCat 2.0nonevsQwen3.5-35B-A3BmediumGemini 3.5 FlashminimalvsKimi K2.5mediumDots 3 Note Previewlowمتاح مجانًاvsLongCat 2.0noneDots 3 Note Previewhighمتاح مجانًاvsLongCat 2.0noneGemini 3.5 Flash LitelowvsLongCat 2.0noneGemini 3.1 Flash Lite PreviewlowvsLongCat 2.0noneLongCat 2.0nonevsMiMo-V2.5-PromediumDots 3 Note Previewhighمتاح مجانًاvsKimi K2.5mediumDots 3 Note Previewlowمتاح مجانًاvsKimi K2.5mediumGemini 3.5 FlashminimalvsLongCat 2.0noneMercury 2.5mediumvsLongCat 2.0noneGemini 3 Flash PreviewnonevsKimi K2.5medium