التنقل
Advertise here

GPT-6 Luna (medium) vs Qwen3.5-122B-A10B (medium)

يتقدم GPT-6 Luna (medium) في متوسط النتيجة بـ 8.3 مقابل 7.0. لدى GPT-6 Luna (medium) تكلفة benchmark أقل عند $0.047 مقابل $1.152. GPT-6 Luna (medium) أسرع عند 18.07s مقابل 66.96s، مع معدلات نجاح 73.9% مقابل 71.0%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-09

النماذج المقارنة

الترتيب
#83
إجمالي رموز الإخراج
53,161
زمن الاستجابة (المتوسط)
18.07s
إجمالي التكلفة
$0.047
الترتيب
#170
إجمالي رموز الإخراج
522,190
زمن الاستجابة (المتوسط)
66.96s
إجمالي التكلفة
$1.152
النموذج الموصى به GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 24.6x less than Qwen3.5-122B-A10B (medium).

مقارنة تفصيلية

المقياس GPT-6 Luna GPT-6 Luna medium الإصدار: 2026-09-23 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium الإصدار: 2026-02-24
النتيجة 8.3 7.0
الترتيب #83 #170
الموثوقية 10.0 10.0
الاتساق 8.9 8.3
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 73.9% 71.0%
اختبارات غير مستقرة 3 5
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 0.313 9.196
إجمالي التكلفة $0.047 $1.152
سعر الإدخال $0.100 / 1M $0.260 / 1M
سعر الإخراج $0.500 / 1M $2.080 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.010 / 1M غير متاح
سعر الكتابة في ذاكرة التخزين المؤقت $0.125 / 1M غير متاح
إجمالي رموز الإدخال 203,193 251,695
رموز الإخراج 5,751 49,415
رموز الاستدلال 47,410 472,775
زمن الاستجابة (المتوسط) 18.07s 66.96s
زمن الاستجابة (الحد الأقصى) 66.44s 519.30s
زمن الاستجابة (الإجمالي) 415.53s 1539.99s
المعلمات ~400B الإجمالي (~17B النشطة) 122B الإجمالي (10B النشطة)
الإتاحة مغلق المصدر مفتوح المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 GPT-6 Luna

medium
التكلفة
$0.002
الوقت
23.6s
الرموز
2,966 tok

#170 Qwen3.5-122B-A10B

medium
التكلفة
$0.019
الوقت
48.7s
الرموز
6,034 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

تبديل زوج المقارنة