Рейтинг Решение головоломок
Посмотрите, какие AI-модели лучше всего справляются с Решение головоломок, какие остаются надежными и где заметнее всего разница. Сортировать по: Метрика ↑.
Показано моделей
15
Среднее значение Оценка Решение головоломок
6.9
Лучшая модель
Step 3.5 Flash 0.0
330/330
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Решение головоломок | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #314 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 4.0 | $0.000 | 0/3 | 2.64s |
| #319 | Ling 3.0 Tiny high | Inclusionai | 3.0 | 3.8 | $0.000 | 0/3 | 54.2s |
| #320 | Ling 3.0 Tiny low | Inclusionai | 3.0 | 3.8 | $0.000 | 0/3 | 32.5s |
| #321 | Grok 4.1 Fast none | X AI | 3.0 | 3.8 | $0.008 | 0/3 | 1.10s |
| #322 | Qwen3.5-9B medium | Qwen | 3.0 | 3.8 | $0.062 | 0/3 | 32.3s |
| #327 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.0 | 3.2 | $0.000 | 0/3 | 532ms |
| #265 | Granite 4.2 8B medium | IBM Granite | 3.1 | 5.2 | $0.008 | 0/3 | 76.0s |
| #248 | DeepSeek V4 Flash 0423 none | DeepSeek | 3.1 | 5.4 | $0.040 | 0/3 | 23.7s |
| #251 | KAT-Coder-Air V2.5 low | Kwaipilot | 3.1 | 5.4 | $0.046 | 0/3 | 1.57s |
| #167 | LongCat 2.0 low | Meituan | 3.1 | 6.7 | $0.412 | 0/3 | 8.15s |
| #215 | Qwen3.5-Flash none | Qwen | 3.1 | 6.0 | $0.073 | 0/3 | 10.9s |
| #250 | Laguna S 2.1 medium | Poolside | 3.1 | 5.4 | $0.053 | 0/3 | 2.62s |
| #260 | Ling-2.6-1T none | Inclusionai | 3.1 | 5.3 | $0.016 | 0/3 | 5.36s |
| #298 | Mercury 2 none | Inception | 3.1 | 4.7 | $0.030 | 0/3 | 535ms |
| #302 | Laguna S 2.1 none | Poolside | 3.1 | 4.5 | $0.022 | 0/3 | 828ms |