التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Google: Gemini 3.1 Flash Lite Preview

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-29

المقياس Claude Opus 4.7 Claude Opus 4.7 medium الإصدار: 2026-04-16 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low الإصدار: 2026-03-03
النتيجة 8.9 7.6
الترتيب #7 #50
الموثوقية 10.0 10.0
الاتساق 10.0 10.0
اختبارات صحيحة
معدل النجاح لكل محاولة 85.0% 65.0%
اختبارات غير مستقرة 0 0
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 3.670 0.186
إجمالي التكلفة $0.624 $0.025
سعر الإدخال $5.000 / 1M $0.250 / 1M
سعر الإخراج $25.000 / 1M $1.500 / 1M
رموز الإخراج 10,439 2,280
رموز الاستدلال 2,198 8,829
زمن الاستجابة (المتوسط) 4.48s 2.85s
زمن الاستجابة (الحد الأقصى) 23.18s 11.91s
زمن الاستجابة (الإجمالي) 85.21s 57.08s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 462 1,638
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 14.79s 6,210 1,114
Gemini 3.1 Flash Lite Preview 6.8 10.0 50.0% 0 1.56s 654 723
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 225 762
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 291 696
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 18 1,212
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 69 384
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.43s 370 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.69s 243 1,248
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 3.0 10.0 0.0% 0 2.25s 24 0
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 1.35s 9 420

مقارنة سريعة

تبديل زوج المقارنة