فئة AI BENCHY
ترتيب حيل مضادة للذكاء الاصطناعي
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في حيل مضادة للذكاء الاصطناعي، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات.
النماذج المعروضة
15
متوسط درجة حيل مضادة للذكاء الاصطناعي
6.7
أفضل نموذج
Gemini 3 Flash Preview 10.0| الترتيب | النموذج | الشركة | درجة حيل مضادة للذكاء الاصطناعي | النتيجة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|
| #6 | Seed-2.0-Lite medium | Bytedance Seed | 8.3 | 8.6 | 3/4 | 18.0s |
| #16 | GPT-5.4 medium | OpenAI | 8.3 | 8.2 | 3/4 | 4.11s |
| #21 | Gemini 3 Flash Preview none | 8.3 | 8.1 | 3/4 | 1.25s | |
| #22 | Gemini 3.1 Flash Lite Preview low | 8.3 | 8.1 | 3/4 | 2.12s | |
| #38 | GPT-5.4 Nano medium | OpenAI | 8.3 | 7.6 | 3/4 | 4.52s |
| #60 | Gemma 4 26B A4B none | 8.3 | 6.2 | 3/4 | 1.28s | |
| #8 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 8.2 | 8.5 | 3/4 | 45.8s |
| #47 | Grok 4.20 medium | X AI | 8.2 | 7.0 | 3/4 | 3.36s |
| #41 | MiMo-V2-Flash medium | Xiaomi | 8.1 | 7.5 | 3/4 | 15.8s |
| #71 | MiniMax M2.5 medium | Minimax | 7.9 | 5.7 | 2/4 | 20.8s |
| #80 | MiniMax M2.7 medium | Minimax | 7.9 | 5.3 | 2/4 | 40.3s |
| #29 | Gemini 3.1 Flash Lite Preview none | 7.5 | 7.9 | 2/4 | 1.04s | |
| #46 | Kimi K2.5 medium | Moonshot AI | 7.3 | 7.0 | 2/4 | 51.4s |
| #50 | Hunter Alpha medium | OpenRouter | 7.3 | 6.7 | 2/4 | 4.75s |
| #31 | GLM 5V Turbo medium | Z.ai | 7.2 | 7.8 | 2/4 | 10.8s |