Рейтинг Решение головоломок
Посмотрите, какие AI-модели лучше всего справляются с Решение головоломок, какие остаются надежными и где заметнее всего разница. Сортировать по: Время ответа (среднее) ↑.
Показано моделей
13
Среднее значение Оценка Решение головоломок
7.0
Лучшая модель
Step 3.5 Flash 0.0
343/343
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Решение головоломок | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #139 | Muse Glimmer 30B high | Meta | 6.1 | 7.2 | $0.430 | 1/3 | 64.8s |
| #135 | DeepSeek V4 Flash 0731 medium | DeepSeek | 8.2 | 7.3 | $0.216 | 2/3 | 65.1s |
| #125 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 3/3 | 65.5s |
| #76 | Muse Spark 1.1 high | Meta | 7.8 | 8.0 | $2.253 | 2/3 | 70.0s |
| #278 | Granite 4.2 8B medium | IBM Granite | 3.1 | 5.2 | $0.008 | 0/3 | 76.0s |
| #282 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/3 | 90.8s |
| #61 | MiMo-V2.6-Pro medium | Xiaomi | 8.4 | 8.4 | $0.477 | 2/3 | 92.2s |
| #321 | Granite 4.2 8B none | IBM Granite | 3.0 | 4.3 | $0.037 | 0/3 | 107.6s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 10.0 | 8.9 | $2.736 | 3/3 | 134.1s |
| #73 | Muse Glimmer 30B xhigh | Meta | 7.8 | 8.1 | $0.510 | 2/3 | 199.7s |
| #60 | Qwen3.8 27B high | Qwen | 7.6 | 8.4 | ~$0.287 | 2/3 | 199.9s |
| #312 | Granite 4.2 8B high | IBM Granite | 2.9 | 4.6 | $0.135 | 0/3 | 202.7s |
| #255 | Hy4 preview low | Tencent | 5.3 | 5.6 | $1.745 | 0/3 | 238.0s |