ترتيب حل الألغاز
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في حل الألغاز، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: زمن الاستجابة (المتوسط) ↑.
311/311
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة حل الألغاز | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #49 | Seed 2.1 Turbo medium | Bytedance Seed | 9.9 | 8.4 | $1.951 | 3/3 | 21.0s |
| #184 | gpt-oss-120b medium | OpenAI | 5.3 | 6.1 | $0.020 | 1/3 | 21.7s |
| #126 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 22.5s |
| #18 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 3/3 | 23.5s |
| #233 | DeepSeek V4 Flash 0423 none | DeepSeek | 3.1 | 5.4 | $0.037 | 0/3 | 23.7s |
| #268 | Hy4 preview none | Tencent | 4.6 | 4.8 | $0.041 | 0/3 | 24.1s |
| #40 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 3/3 | 24.3s |
| #254 | Qwen3 Coder Next none | Qwen | 3.0 | 5.1 | $0.026 | 0/3 | 24.3s |
| #258 | North Mini Code none | Cohere | 3.5 | 5.1 | $0.000 | 0/3 | 24.4s |
| #259 | MiniMax M2.7 medium | Minimax | 5.9 | 5.0 | $0.208 | 1/3 | 24.9s |
| #29 | Muse Spark 1.3 medium | Meta | 10.0 | 8.8 | $1.469 | 3/3 | 25.0s |
| #116 | Kimi K2.6 medium | Moonshot AI | 6.0 | 7.2 | $1.247 | 1/3 | 25.1s |
| #84 | DeepSeek V4 Flash 0423 high | DeepSeek | 8.2 | 7.6 | $0.039 | 2/3 | 26.1s |
| #179 | Gemma 4 31B medium | 9.9 | 6.2 | $0.100 | 3/3 | 26.9s | |
| #27 | Seed 2.1 Turbo high | Bytedance Seed | 10.0 | 8.9 | $1.797 | 3/3 | 27.3s |