ترتيب حل الألغاز
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في حل الألغاز، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: المقياس ↑.
210/210
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة حل الألغاز | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #14 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.931 | 3/3 | 3.95s |
| #15 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.477 | 3/3 | 2.43s |
| #19 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.4 | $1.143 | 3/3 | 24.3s |
| #20 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.935 | 3/3 | 3.20s |
| #22 | Grok 4.5 medium | X AI | 10.0 | 8.3 | $1.928 | 3/3 | 7.75s |
| #32 | Inkling medium | Thinkingmachines | 10.0 | 8.0 | $0.391 | 3/3 | 5.18s |
| #33 | Kimi K3 max | Moonshot AI | 10.0 | 8.0 | $3.112 | 3/3 | 7.36s |
| #36 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.267 | 3/3 | 16.4s |
| #37 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.405 | 3/3 | 6.34s |
| #40 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.057 | 3/3 | 5.31s |
| #41 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.077 | 3/3 | 3.01s |
| #42 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.307 | 3/3 | 11.3s |
| #54 | GPT-5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.571 | 3/3 | 2.99s |
| #55 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.519 | 3/3 | 4.46s |
| #57 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.437 | 3/3 | 32.5s |