Рейтинг Решение головоломок
Посмотрите, какие AI-модели лучше всего справляются с Решение головоломок, какие остаются надежными и где заметнее всего разница. Сортировать по: Время ответа (среднее) ↓.
Показано моделей
15
Среднее значение Оценка Решение головоломок
6.7
Лучшая модель
Muse Spark 1.1 7.8
216/216
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Решение головоломок | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #75 | Qwen3.7 Plus none | Qwen | 7.7 | 7.2 | $0.106 | 2/3 | 1.71s |
| #104 | Gemini 3.5 Flash-Lite medium | 8.4 | 6.5 | $0.369 | 2/3 | 1.70s | |
| #110 | Gemini 3.1 Flash Lite Preview low | 10.0 | 6.5 | $0.646 | 3/3 | 1.69s | |
| #153 | Mimo V2 PRO none | Xiaomi | 6.0 | 5.6 | $0.045 | 1/3 | 1.61s |
| #164 | KAT-Coder-Air V2.5 low | Kwaipilot | 3.1 | 5.4 | $0.041 | 0/3 | 1.57s |
| #87 | GPT-5.6 Sol none | OpenAI | 7.7 | 6.9 | $0.524 | 2/3 | 1.49s |
| #157 | GLM 5.1 none | Z.ai | 7.7 | 5.5 | $0.164 | 2/3 | 1.45s |
| #92 | Gemini 3.5 Flash minimal | 10.0 | 6.8 | $0.300 | 3/3 | 1.45s | |
| #145 | GPT-5.4 none | OpenAI | 5.6 | 5.8 | $0.397 | 1/3 | 1.44s |
| #111 | Gemini 3.1 Flash Lite low | 10.0 | 6.5 | $0.621 | 3/3 | 1.40s | |
| #144 | Kimi K2.6 none | Moonshot AI | 3.1 | 5.8 | $0.184 | 0/3 | 1.40s |
| #213 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 2.9 | 3.4 | $0.000 | 0/3 | 1.40s |
| #109 | Qwen3.5-27B none | Qwen | 6.7 | 6.5 | $0.090 | 1/3 | 1.38s |
| #133 | Qwen3.5-35B-A3B none | Qwen | 3.7 | 6.1 | $0.106 | 0/3 | 1.35s |
| #160 | MiMo-V2.5-Pro none | Xiaomi | 6.7 | 5.5 | $0.068 | 1/3 | 1.30s |