فئة AI BENCHY
ترتيب حيل مضادة للذكاء الاصطناعي
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في حيل مضادة للذكاء الاصطناعي، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات.
النماذج المعروضة
15
متوسط درجة حيل مضادة للذكاء الاصطناعي
6.7
أفضل نموذج
Gemini 3 Flash Preview 10.0| الترتيب | النموذج | الشركة | درجة حيل مضادة للذكاء الاصطناعي | النتيجة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|
| #45 | GPT-5 Mini medium | OpenAI | 7.1 | 7.0 | 2/4 | 13.9s |
| #34 | Kimi K2.6 medium | Moonshot AI | 7.0 | 7.7 | 2/4 | 11.6s |
| #54 | Mercury 2 medium | Inception | 6.9 | 6.5 | 2/4 | 1.12s |
| #56 | Grok 4.20 Multi Agent Beta medium | X AI | 6.9 | 6.4 | 2/4 | 3.46s |
| #36 | GPT-5.3 Chat none | OpenAI | 6.7 | 7.7 | 2/4 | 3.86s |
| #68 | gpt-oss-120b medium | OpenAI | 6.7 | 5.8 | 2/4 | 10.2s |
| #84 | gpt-oss-120b none | OpenAI | 6.6 | 5.2 | 2/4 | 6.03s |
| #39 | Seed-2.0-Mini medium | Bytedance Seed | 6.6 | 7.5 | 2/4 | 74.7s |
| #81 | Elephant medium | Openrouter | 6.6 | 5.2 | 2/4 | 1.19s |
| #85 | Elephant none | Openrouter | 6.6 | 5.2 | 2/4 | 963ms |
| #40 | GPT-5.2 medium | OpenAI | 6.5 | 7.5 | 2/4 | 7.81s |
| #26 | Claude Sonnet 4.6 medium | Anthropic | 6.5 | 8.0 | 2/4 | 2.98s |
| #48 | Gemma 4 31B none | 6.5 | 6.9 | 2/4 | 1.85s | |
| #57 | GPT-5 Nano medium | OpenAI | 6.5 | 6.3 | 2/4 | 25.5s |
| #37 | Claude Opus 4.6 medium | Anthropic | 6.4 | 7.6 | 2/4 | 7.45s |