التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek: DeepSeek V4 Pro vs Google: Gemini 3.5 Flash-Lite

يتقدم DeepSeek V4 Pro في متوسط النتيجة بـ 6.9 مقابل 6.7. لدى DeepSeek V4 Pro تكلفة benchmark أقل عند $0.096 مقابل $0.145. Gemini 3.5 Flash-Lite (low) أسرع عند 2.25s مقابل 11.55s، مع معدلات نجاح 51.5% مقابل 66.7%.

النموذج الموصى بهGemini 3.5 Flash-Lite (low)Its score stays close to the best score here (6.7 vs 6.9), while responding about 5.1x faster than DeepSeek V4 Pro.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-21

المقياس DeepSeek V4 Pro DeepSeek V4 Pro none الإصدار: 2026-04-24 Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite low الإصدار: 2026-07-21
النتيجة 6.9 6.7
الترتيب #86 #95
الموثوقية 10.0 10.0
الاتساق 8.6 8.2
اختبارات صحيحة
معدل النجاح لكل محاولة 51.5% 66.7%
اختبارات غير مستقرة 4 5
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 0.954 1.201
إجمالي التكلفة $0.096 $0.145
سعر الإدخال $0.435 / 1M $0.300 / 1M
سعر الإخراج $0.870 / 1M $2.500 / 1M
إجمالي رموز الإدخال 148,069 144,622
رموز الإخراج 35,551 15,302
رموز الاستدلال 0 24,971
زمن الاستجابة (المتوسط) 11.55s 2.25s
زمن الاستجابة (الحد الأقصى) 119.44s 13.50s
زمن الاستجابة (الإجمالي) 254.11s 49.58s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 DeepSeek V4 Pro

none
SVG غير صالح
التكلفة
$0.000
الوقت
300.0s
الرموز
0 tok

#95 Gemini 3.5 Flash-Lite

low
التكلفة
$0.008
الوقت
7.7s
الرموز
3,056 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
Gemini 3.5 Flash-Lite 4.1 7.9 11.1% 1 672ms 8,136 463 0

مقارنة سريعة

تبديل زوج المقارنة