التنقل
Advertise here

Seed-2.0-Mini (medium) vs Qwen3.8 Flash Next (medium)

يتقدم Qwen3.8 Flash Next (medium) في متوسط النتيجة بـ 7.6 مقابل 7.5. لدى Qwen3.8 Flash Next (medium) تكلفة benchmark أقل عند ~$0.047 مقابل $0.140. Qwen3.8 Flash Next (medium) أسرع عند 24.79s مقابل 91.67s، مع معدلات نجاح 59.4% مقابل 75.4%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-05

النماذج المقارنة

الترتيب
#124
إجمالي رموز الإخراج
271,559
زمن الاستجابة (المتوسط)
91.67s
إجمالي التكلفة
$0.140
الترتيب
#119
إجمالي رموز الإخراج
143,965
زمن الاستجابة (المتوسط)
24.79s
إجمالي التكلفة
~$0.047
النموذج الموصى به Qwen3.8 Flash Next (medium)

It has the best score here (7.6), while costing about 3.0x less than Seed-2.0-Mini (medium).

مقارنة تفصيلية

المقياس Seed-2.0-Mini Seed-2.0-Mini medium الإصدار: 2026-02-14 Qwen3.8 Flash Next Qwen3.8 Flash Next medium الإصدار: 2026-10-04
النتيجة 7.5 7.6
الترتيب #124 #119
الموثوقية 9.4 10.0
الاتساق 9.0 7.9
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 59.4% 75.4%
اختبارات غير مستقرة 3 6
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 1.167 ~0.314
إجمالي التكلفة $0.140 ~$0.047
سعر الإدخال $0.100 / 1M غير متاح
سعر الإخراج $0.400 / 1M غير متاح
سعر قراءة ذاكرة التخزين المؤقت غير متاح غير متاح
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 313,368 278,792
رموز الإخراج 12,289 1,695
رموز الاستدلال 259,270 142,270
زمن الاستجابة (المتوسط) 91.67s 24.79s
زمن الاستجابة (الحد الأقصى) 301.78s 159.62s
زمن الاستجابة (الإجمالي) 1833.43s 570.26s
المعلمات ~50B الإجمالي (~5B النشطة) 180B الإجمالي (6B النشطة)
الإتاحة مغلق المصدر الأوزان متاحة

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#124 Seed-2.0-Mini

medium
التكلفة
$0.002
الوقت
161.7s
الرموز
4,379 tok

#119 Qwen3.8 Flash Next

medium
التكلفة
~$0.002
الوقت
40.7s
الرموز
4,059 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 45.53s 7,893 346 37,643

مقارنة سريعة

تبديل زوج المقارنة

GPT-6 LunalowvsQwen3.8 Flash NextmediumQwen3.8 Flash NextmediumvsSpace Bunny AlphahighSeed-2.0-MinimediumvsSpace Bunny AlphahighSeed-2.0-MinimediumvsQwen3.8 27Blowمتاح مجانًاSeed-2.0-MinimediumvsGPT-6 LunalowSeed-2.0-CodehighvsQwen3.8 Flash NextmediumSeed-2.0-MinimediumvsDeepSeek V4 Flash 0731lowSeed-2.0-MinimediumvsGLM 5.3 FlashXhighSeed-2.0-MinimediumvsGrok 4.7lowSeed-2.0-MinimediumvsInkling Smallhighمتاح مجانًاMuse Glimmer 30BhighvsQwen3.8 Flash NextmediumGPT-6 LunahighvsQwen3.8 Flash Nextmedium