التنقل
Advertise here

Claude Opus 4.7 (medium) vs Qwen3.8 Flash Next (low)

يتقدم Claude Opus 4.7 (medium) في متوسط النتيجة بـ 8.1 مقابل 8.0. لدى Qwen3.8 Flash Next (low) تكلفة benchmark أقل عند ~$0.045 مقابل $3.636. Claude Opus 4.7 (medium) أسرع عند 14.12s مقابل 23.66s، مع معدلات نجاح 81.2% مقابل 79.7%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-07

النماذج المقارنة

الترتيب
#93
إجمالي رموز الإخراج
57,978
زمن الاستجابة (المتوسط)
14.12s
إجمالي التكلفة
$3.636
الترتيب
#100
إجمالي رموز الإخراج
135,295
زمن الاستجابة (المتوسط)
23.66s
إجمالي التكلفة
~$0.045
النموذج الموصى به Qwen3.8 Flash Next (low)

Its score stays close to the best score here (8.0 vs 8.1), while costing about 81.1x less than Claude Opus 4.7 (medium).

مقارنة تفصيلية

المقياس Claude Opus 4.7 Claude Opus 4.7 medium الإصدار: 2026-04-16 Qwen3.8 Flash Next Qwen3.8 Flash Next low الإصدار: 2026-10-04
النتيجة 8.1 8.0
الترتيب #93 #100
الموثوقية 10.0 10.0
الاتساق 9.3 8.0
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 81.2% 79.7%
اختبارات غير مستقرة 2 6
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 20.200 ~0.299
إجمالي التكلفة $3.636 ~$0.045
سعر الإدخال $5.000 / 1M غير متاح
سعر الإخراج $25.000 / 1M غير متاح
سعر قراءة ذاكرة التخزين المؤقت $0.500 / 1M غير متاح
سعر الكتابة في ذاكرة التخزين المؤقت $6.250 / 1M غير متاح
إجمالي رموز الإدخال 437,293 342,163
رموز الإخراج 29,102 1,518
رموز الاستدلال 28,876 133,777
زمن الاستجابة (المتوسط) 14.12s 23.66s
زمن الاستجابة (الحد الأقصى) 150.60s 166.72s
زمن الاستجابة (الإجمالي) 310.55s 544.16s
المعلمات ~5T الإجمالي (~500B النشطة) 180B الإجمالي (6B النشطة)
الإتاحة مغلق المصدر الأوزان متاحة

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Claude Opus 4.7

medium
التكلفة
$0.059
الوقت
26.8s
الرموز
2,475 tok

#100 Qwen3.8 Flash Next

low
التكلفة
~$0.002
الوقت
47.2s
الرموز
5,270 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

تبديل زوج المقارنة

Claude Opus 4.7mediumvsDeepSeek V4 Flash 0423highGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsDeepSeek V4 Pro 0423highClaude Opus 4.7mediumvsDeepSeek V4.1 FlashlowQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 Ultramediumمتاح مجانًاvsQwen3.8 Flash NextlowGPT-5.4 MinimediumvsQwen3.8 Flash NextlowGPT-5.6 LunahighvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsGPT-5.6 LunahighClaude Opus 4.7mediumvsSeed-2.0-Codelow