AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Категория AI BENCHY

Рейтинг Решение головоломок

Посмотрите, какие AI-модели лучше всего справляются с Решение головоломок, какие остаются надежными и где заметнее всего разница. Сортировать по: Тестов верно ↓.

Показано моделей

15

Среднее значение Оценка Решение головоломок

6.4

Лучшая модель

Gemini 3 Flash Preview 10.0
Ранг Модель Компания Оценка Решение головоломок Оценка Тестов верно Время ответа (среднее)
#44 GPT-5.4 Mini medium OpenAI 6.8 7.3 1/3 4.33s
#45 GPT-5 Mini medium OpenAI 5.6 7.0 1/3 14.1s
#46 Kimi K2.5 medium Moonshot AI 5.3 7.0 1/3 45.4s
#47 Grok 4.20 medium X AI 6.4 7.0 1/3 3.89s
#48 Gemma 4 31B none Google 5.5 6.9 1/3 2.95s
#50 Hunter Alpha medium OpenRouter 6.1 6.7 1/3 5.36s
#52 Grok 4.1 Fast medium X AI 5.3 6.7 1/3 8.08s
#56 Grok 4.20 Multi Agent Beta medium X AI 7.2 6.4 1/3 5.01s
#57 GPT-5 Nano medium OpenAI 5.3 6.3 1/3 19.8s
#58 GLM 5V Turbo none Z.ai 5.3 6.2 1/3 2.22s
#60 Gemma 4 26B A4B none Google 5.7 6.2 1/3 739ms
#61 Seed-2.0-Lite none Bytedance Seed 5.2 6.2 1/3 2.46s
#62 Gemini 2.5 Flash none Google 5.7 6.2 1/3 576ms
#65 MiMo-V2-Pro none Xiaomi 6.0 6.0 1/3 1.83s
#66 GPT-5.4 none OpenAI 5.6 5.9 1/3 1.52s

Лучшие модели по Оценка Решение головоломок

Оценка Решение головоломок vs общая стоимость

Лучшие модели по Время ответа (среднее)