Рейтинг Решение головоломок
Посмотрите, какие AI-модели лучше всего справляются с Решение головоломок, какие остаются надежными и где заметнее всего разница. Сортировать по: Время ответа (среднее) ↓.
330/330
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Решение головоломок | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #18 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 3/3 | 6.90s | |
| #28 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.163 | 3/3 | 6.76s |
| #64 | Muse Spark 1.1 low | Meta | 8.3 | 8.3 | $0.673 | 2/3 | 6.60s |
| #283 | Ling-2.6-flash none | Inclusionai | 2.9 | 4.9 | $0.002 | 0/3 | 6.51s |
| #84 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 3/3 | 6.34s |
| #154 | Qwen3.6 Flash medium | Qwen | 8.2 | 6.8 | $0.741 | 2/3 | 6.29s |
| #146 | Grok 4.20 medium | X AI | 7.7 | 7.0 | $0.805 | 2/3 | 6.22s |
| #287 | Nemotron 3.5 Lightning low | NVIDIA | 3.6 | 4.8 | $0.140 | 0/3 | 6.21s |
| #81 | Step 3.7 Flash medium | Stepfun | 5.7 | 7.9 | $0.495 | 1/3 | 6.19s |
| #26 | Claude Fable 5.1 high | Anthropic | 10.0 | 9.0 | $3.364 | 3/3 | 6.11s |
| #242 | Nemotron 3.5 Lightning high | NVIDIA | 3.6 | 5.6 | $0.134 | 0/3 | 6.09s |
| #177 | Qwen3.6 35B A3B medium | Qwen | 8.0 | 6.6 | $0.672 | 2/3 | 5.95s |
| #37 | Qwen3.8 Max (0902) medium | Qwen | 10.0 | 8.8 | $0.677 | 3/3 | 5.89s |
| #59 | GPT-5.2 medium | OpenAI | 7.5 | 8.4 | $1.182 | 2/3 | 5.80s |
| #164 | Gemma 4 26B A4B medium | 10.0 | 6.8 | $0.084 | 3/3 | 5.79s |