- الترتيب
- #221
- إجمالي رموز الإخراج
- 143,160
- زمن الاستجابة (المتوسط)
- 70.08s
- إجمالي التكلفة
- $0.145
DeepSeek V3.2 (medium) vs LongCat 2.0
يتقدم LongCat 2.0 في متوسط النتيجة بـ 6.4 مقابل 6.3. لدى LongCat 2.0 تكلفة benchmark أقل عند $0.104 مقابل $0.145. LongCat 2.0 أسرع عند 8.50s مقابل 70.08s، مع معدلات نجاح 62.3% مقابل 42.0%.
النماذج المقارنة
- الترتيب
- #211
- إجمالي رموز الإخراج
- 17,473
- زمن الاستجابة (المتوسط)
- 8.50s
- إجمالي التكلفة
- $0.104
النموذج الموصى به
LongCat 2.0
It has the best score here (6.4), while responding about 8.2x faster than DeepSeek V3.2 (medium).
مقارنة تفصيلية
| المقياس | DeepSeek V3.2 DeepSeek V3.2 medium | LongCat 2.0 LongCat 2.0 none |
|---|---|---|
| النتيجة | 6.3 | 6.4 |
| الترتيب | #221 | #211 |
| الموثوقية | 10.0 | 10.0 |
| الاتساق | 7.5 | 9.0 |
| محاولات | 69/69 | 69/69 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 62.3% | 42.0% |
| اختبارات غير مستقرة | 7 | 3 |
| إجمالي مرات التشغيل | 69 | 69 |
| التكلفة لكل نتيجة | 1.250 | 1.298 |
| إجمالي التكلفة | $0.145 | $0.104 |
| سعر الإدخال | $0.280 / 1M | $0.300 / 1M |
| سعر الإخراج | $0.420 / 1M | $1.200 / 1M |
| إجمالي رموز الإدخال | 306,662 | 276,199 |
| رموز الإخراج | 17,819 | 17,473 |
| رموز الاستدلال | 125,341 | 0 |
| زمن الاستجابة (المتوسط) | 70.08s | 8.50s |
| زمن الاستجابة (الحد الأقصى) | 376.10s | 81.77s |
| زمن الاستجابة (الإجمالي) | 1611.86s | 195.60s |
| المعلمات | 671B الإجمالي (37B النشطة) | 1.6T الإجمالي (48B النشطة) |
| الإتاحة | مفتوح المصدر | مفتوح المصدر |
عرض إنشاء النماذج
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#221 DeepSeek V3.2
medium- التكلفة
- $0.001
- الوقت
- 53.6s
- الرموز
- 1,932 tok
#211 LongCat 2.0
none- التكلفة
- $0.027
- الوقت
- 411.7s
- الرموز
- 22,283 tok
أفضل النماذج حسب الدرجة
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
| مهام الوكلاء | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.0 | 10.0 | 0.0% | 0 | 106.33s | 205,606 | 5,987 | 8,386 | |
| LongCat 2.0 | 6.1 | 3.1 | 66.7% | 1 | 81.77s | 167,447 | 8,098 | 0 |
| حيل مضادة للذكاء الاصطناعي | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 8.2 | 7.9 | 83.3% | 1 | 24.23s | 448 | 3,247 | 6,953 | |
| LongCat 2.0 | 4.8 | 10.0 | 25.0% | 0 | 2.87s | 624 | 503 | 0 |
| البرمجة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 6.0 | 7.2 | 55.6% | 1 | 248.68s | 5,717 | 649 | 52,014 | |
| LongCat 2.0 | 5.5 | 10.0 | 33.3% | 0 | 2.85s | 7,446 | 578 | 0 |
| مجمّع | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 7.3 | 5.8 | 83.3% | 1 | 79.92s | 76,997 | 5,219 | 24,229 | |
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 28.45s | 83,372 | 7,289 | 0 |
| تحليل البيانات واستخراجها | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 10.0 | 10.0 | 100.0% | 0 | 36.09s | 7,388 | 207 | 7,693 | |
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 2.36s | 7,671 | 246 | 0 |
| خاص بالمجال | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 2.9 | 4.4 | 22.2% | 2 | 22.94s | 481 | 19 | 6,779 | |
| LongCat 2.0 | 5.3 | 10.0 | 33.3% | 0 | 1.68s | 738 | 28 | 0 |
| الذكاء العام | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.4 | 2.5 | 33.3% | 1 | 58.29s | 314 | 49 | 2,189 | |
| LongCat 2.0 | 5.0 | 10.0 | 0.0% | 0 | 2.76s | 489 | 111 | 0 |
| اتباع التعليمات | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 10.0 | 10.0 | 100.0% | 0 | 35.78s | 627 | 1,397 | 2,845 | |
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 2.82s | 675 | 66 | 0 |
| حل الألغاز | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 7.0 | 7.2 | 55.6% | 1 | 37.69s | 594 | 518 | 6,375 | |
| LongCat 2.0 | 4.0 | 5.0 | 33.3% | 2 | 2.74s | 663 | 299 | 0 |
| استدعاء الأدوات | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 10.0 | 10.0 | 100.0% | 0 | 34.81s | 8,307 | 507 | 859 | |
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 6.64s | 6,867 | 231 | 0 |
| معلومات عامة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.0 | 10.0 | 0.0% | 0 | 83.99s | 183 | 20 | 7,019 | |
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 3.92s | 207 | 24 | 0 |
مقارنة سريعة
تبديل زوج المقارنة
Trinity Large ThinkinglowvsDeepSeek V3.2mediumLongCat 2.0nonevsQwen3.5-35B-A3BmediumDots 3 Note Previewlowمتاح مجانًاvsLongCat 2.0noneDots 3 Note Previewhighمتاح مجانًاvsLongCat 2.0noneGemini 3.5 Flash LitelowvsLongCat 2.0noneGemini 3.1 Flash Lite PreviewlowvsLongCat 2.0noneLongCat 2.0nonevsMiMo-V2.5-PromediumDeepSeek V3.2mediumvsQwen3.5 Plus 2026-02-15noneDeepSeek V3.2mediumvsSolar Pro 4highDeepSeek V3.2mediumvsGemini 3.1 Flash LitelowGemini 3.5 FlashminimalvsLongCat 2.0noneMercury 2.5mediumvsLongCat 2.0none