ترتيب البرمجة
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في البرمجة، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: إجمالي التكلفة ↑.
408/408
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة البرمجة | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #287 | Gemini 2.5 Flash none | 0.5 | 0.5 | $0.017 | 1/3 | 736ms | |
| #304 | Laguna XS 2.1 none | Poolside | 0.4 | 0.5 | $0.020 | 0/3 | 623ms |
| #314 | Mercury 2.5 low | Inception | 0.5 | 0.5 | $0.020 | 1/3 | 972ms |
| #401 | Step 3.5 Flash none | Stepfun | 1.0 | 0.2 | $0.020 | 0/1 | 0ms |
| #269 | Ling 3.0 Flash high | Inclusionai | 0.7 | 0.6 | $0.021 | 1/3 | 14.9s |
| #354 | Mimo V2 Omni default | Xiaomi | 0.4 | 0.4 | $0.021 | 0/3 | 2.75s |
| #280 | Solar Pro 4 none | Upstage | 0.5 | 0.6 | $0.022 | 1/3 | 2.61s |
| #336 | Mercury 2.5 Preview default | Inception | 0.5 | 0.5 | $0.023 | 0/3 | 459ms |
| #322 | GPT-4o-mini default | OpenAI | 0.3 | 0.5 | $0.024 | 0/3 | 1.63s |
| #388 | MiMo-V2-Flash default | Xiaomi | 0.4 | 0.3 | $0.025 | 0/3 | 2.64s |
| #288 | GPT-6 Luna none | OpenAI | 0.5 | 0.5 | $0.026 | 1/3 | 8.04s |
| #353 | Ring 2.6 1t default | Inclusionai | 0.5 | 0.4 | $0.026 | 1/3 | 143.8s |
| #366 | Mercury 2.5 none | Inception | 0.4 | 0.4 | $0.026 | 0/3 | 12.5s |
| #335 | GLM 4.7 Flash none | Z.ai | 0.4 | 0.5 | $0.027 | 0/3 | 2.54s |
| #265 | Qwen3.7 Flash none | Qwen | 0.5 | 0.6 | $0.028 | 1/3 | 1.55s |