Рейтинг Решение головоломок
Посмотрите, какие AI-модели лучше всего справляются с Решение головоломок, какие остаются надежными и где заметнее всего разница. Сортировать по: Тестов верно ↑.
330/330
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Решение головоломок | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #7 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 3/3 | 3.43s | |
| #9 | GPT-6 Astra low | OpenAI | 10.0 | 9.5 | $1.289 | 3/3 | 2.44s |
| #10 | Gemini 3 Flash Preview medium | 10.0 | 9.5 | $0.763 | 3/3 | 4.05s | |
| #11 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 3/3 | 3.23s | |
| #12 | Gemini 3.7 Flash medium | 10.0 | 9.4 | $0.309 | 3/3 | 2.33s | |
| #14 | GPT-6 Astra medium | OpenAI | 10.0 | 9.4 | $1.774 | 3/3 | 2.54s |
| #15 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.446 | 3/3 | 4.10s |
| #16 | GPT-5.5 low | OpenAI | 10.0 | 9.3 | $1.257 | 3/3 | 4.74s |
| #17 | Grok 4.6 high | X AI | 10.0 | 9.3 | $1.908 | 3/3 | 15.6s |
| #18 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 3/3 | 6.90s | |
| #19 | Gemini 3.7 Flash low | 10.0 | 9.2 | $0.207 | 3/3 | 1.92s | |
| #20 | Claude Opus 5 high | Anthropic | 10.0 | 9.2 | $3.070 | 3/3 | 4.66s |
| #21 | Claude Opus 5 medium | Anthropic | 10.0 | 9.2 | $1.586 | 3/3 | 4.27s |
| #22 | Gemini 3.8 Flash medium | 10.0 | 9.1 | $0.653 | 3/3 | 2.73s | |
| #23 | Qwen3.8 Max (0902) low | Qwen | 10.0 | 9.1 | $0.664 | 3/3 | 4.49s |