AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY 分类

反AI技巧 排名

看看哪些 AI 模型在 反AI技巧 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 测试正确 ↓.

显示的模型数

15

反AI技巧 得分 平均值

6.7

排名 模型 公司 反AI技巧 得分 分数 测试正确 响应时间(平均)
#39 Seed-2.0-Mini medium Bytedance Seed 6.6 7.5 2/4 74.7s
#40 GPT-5.2 medium OpenAI 6.5 7.5 2/4 7.81s
#45 GPT-5 Mini medium OpenAI 7.1 7.0 2/4 13.9s
#46 Kimi K2.5 medium Moonshot AI 7.3 7.0 2/4 51.4s
#48 Gemma 4 31B none Google 6.5 6.9 2/4 1.85s
#50 Hunter Alpha medium OpenRouter 7.3 6.7 2/4 4.75s
#54 Mercury 2 medium Inception 6.9 6.5 2/4 1.12s
#56 Grok 4.20 Multi Agent Beta medium X AI 6.9 6.4 2/4 3.46s
#57 GPT-5 Nano medium OpenAI 6.5 6.3 2/4 25.5s
#68 gpt-oss-120b medium OpenAI 6.7 5.8 2/4 10.2s
#71 MiniMax M2.5 medium Minimax 7.9 5.7 2/4 20.8s
#80 MiniMax M2.7 medium Minimax 7.9 5.3 2/4 40.3s
#81 Elephant medium Openrouter 6.6 5.2 2/4 1.19s
#84 gpt-oss-120b none OpenAI 6.6 5.2 2/4 6.03s
#85 Elephant none Openrouter 6.6 5.2 2/4 963ms

按 反AI技巧 得分 排名的顶级模型

反AI技巧 得分 vs 总成本

按 响应时间(平均) 排名的顶级模型