التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna vs Qwen3.5-35B-A3B

يتقدم Qwen3.5-35B-A3B في متوسط النتيجة بـ 5.6 مقابل 5.5. لدى GPT-6 Luna تكلفة benchmark أقل عند $0.026 مقابل $0.120. Qwen3.5-35B-A3B أسرع عند 18.31s مقابل 20.48s، مع معدلات نجاح 40.6% مقابل 37.7%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-09

النماذج المقارنة

الترتيب
#288
إجمالي رموز الإخراج
6,855
زمن الاستجابة (المتوسط)
20.48s
إجمالي التكلفة
$0.026
الترتيب
#283
إجمالي رموز الإخراج
135,768
زمن الاستجابة (المتوسط)
18.31s
إجمالي التكلفة
$0.120
النموذج الموصى به GPT-6 Luna

Its score stays close to the best score here (5.5 vs 5.6), while costing about 4.7x less than Qwen3.5-35B-A3B.

مقارنة تفصيلية

المقياس GPT-6 Luna GPT-6 Luna none الإصدار: 2026-09-23 Qwen3.5-35B-A3B Qwen3.5-35B-A3B none الإصدار: 2026-02-24
النتيجة 5.5 5.6
الترتيب #288 #283
الموثوقية 9.9 10.0
الاتساق 8.2 8.6
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 40.6% 37.7%
اختبارات غير مستقرة 5 4
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 0.367 3.135
إجمالي التكلفة $0.026 $0.120
سعر الإدخال $0.100 / 1M $0.080 / 1M
سعر الإخراج $0.500 / 1M $0.750 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.010 / 1M $0.040 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت $0.125 / 1M غير متاح
إجمالي رموز الإدخال 222,357 218,886
رموز الإخراج 6,855 135,768
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 20.48s 18.31s
زمن الاستجابة (الحد الأقصى) 98.62s 209.15s
زمن الاستجابة (الإجمالي) 470.96s 421.19s
المعلمات ~400B الإجمالي (~17B النشطة) 35B الإجمالي (3B النشطة)
الإتاحة مغلق المصدر مفتوح المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#288 GPT-6 Luna

none
التكلفة
$0.002
الوقت
26.0s
الرموز
3,235 tok

#283 Qwen3.5-35B-A3B

none
التكلفة
$0.005
الوقت
28.4s
الرموز
4,518 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0
Qwen3.5-35B-A3B 5.5 10.0 33.3% 0 1.39s 7,808 571 0

تبديل زوج المقارنة