التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

gpt-oss-120b vs Qwen3 Coder Next (medium)

يتقدم Qwen3 Coder Next (medium) في متوسط النتيجة بـ 4.6 مقابل 3.7. لدى gpt-oss-120b تكلفة benchmark أقل عند $0.033 مقابل $0.034. Qwen3 Coder Next (medium) أسرع عند 9.07s مقابل 21.61s، مع معدلات نجاح 33.3% مقابل 25.8%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-09-18

النماذج المقارنة

الترتيب
#325
إجمالي رموز الإخراج
51,664
زمن الاستجابة (المتوسط)
21.61s
إجمالي التكلفة
$0.033
الترتيب
#300
إجمالي رموز الإخراج
19,069
زمن الاستجابة (المتوسط)
9.07s
إجمالي التكلفة
$0.034
النموذج الموصى به Qwen3 Coder Next (medium)

It has the best score here (4.6), while responding about 2.4x faster than gpt-oss-120b.

مقارنة تفصيلية

المقياس gpt-oss-120b gpt-oss-120b none الإصدار: 2025-08-05 متاح مجانًا Qwen3 Coder Next Qwen3 Coder Next medium الإصدار: 2026-02-03
النتيجة 3.7 4.6
الترتيب #325 #300
الموثوقية 10.0 10.0
الاتساق 7.8 8.6
محاولات 57/66 66/66
اختبارات صحيحة
معدل النجاح لكل محاولة 33.3% 25.8%
اختبارات غير مستقرة 2 4
إجمالي مرات التشغيل 57 66
التكلفة لكل نتيجة 0.168 1.058
إجمالي التكلفة $0.033 $0.034
سعر الإدخال $0.150 / 1M $0.120 / 1M
سعر الإخراج $0.600 / 1M $0.800 / 1M
إجمالي رموز الإدخال 9,081 148,203
رموز الإخراج 51,664 19,069
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 21.61s 9.07s
زمن الاستجابة (الحد الأقصى) 113.71s 81.80s
زمن الاستجابة (الإجمالي) 345.79s 154.19s
المعلمات 117B الإجمالي (5.1B النشطة) 80B الإجمالي (3B النشطة)
الإتاحة مفتوح المصدر مفتوح المصدر

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#325 gpt-oss-120b

none
لم يتم إنشاء نتيجة عرض لهذا النموذج بعد.
التكلفة
غير متاح
الوقت
-
الرموز
0 tok

#300 Qwen3 Coder Next

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
التكلفة
$0.000
الوقت
300.0s
الرموز
0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
Qwen3 Coder Next 3.7 7.2 22.2% 1 924ms 7,185 336 0

مقارنة سريعة

تبديل زوج المقارنة