Рейтинг Эрудиция
Посмотрите, какие AI-модели лучше всего справляются с Эрудиция, какие остаются надежными и где заметнее всего разница. Сортировать по: Общая стоимость ↓.
Показано моделей
15
Среднее значение Оценка Эрудиция
3.2
Лучшая модель
Grok 4.20 Multi Agent Beta 0.0
250/250
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Эрудиция | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #171 | Qwen3.5-122B-A10B none | Qwen | 3.0 | 5.7 | $0.283 | 0/1 | 295ms |
| #53 | Gemini 3.5 Flash Lite medium | 2.8 | 7.8 | $0.273 | 0/1 | 3.75s | |
| #55 | GPT-5.6 Terra medium | OpenAI | 3.0 | 7.8 | $0.271 | 0/1 | 10.1s |
| #51 | Qwen3.7 Plus medium | Qwen | 3.0 | 7.9 | $0.267 | 0/1 | 91.1s |
| #40 | GPT-5 Mini medium | OpenAI | 3.0 | 8.1 | $0.237 | 0/1 | 9.99s |
| #50 | Seed-2.0-Lite medium | Bytedance Seed | 3.0 | 7.9 | $0.234 | 0/1 | 48.3s |
| #120 | Qwen3.6 Max Preview none | Qwen | 3.0 | 6.6 | $0.228 | 0/1 | 1.97s |
| #73 | GPT-5.6 Terra low | OpenAI | 3.0 | 7.5 | $0.208 | 0/1 | 5.95s |
| #63 | DeepSeek V4 Pro high | DeepSeek | 3.0 | 7.7 | $0.200 | 0/1 | 34.0s |
| #77 | Qwen3.7 Max none | Qwen | 3.0 | 7.4 | $0.197 | 0/1 | 856ms |
| #105 | MiMo-V2.5-Pro medium | Xiaomi | 3.0 | 6.9 | $0.187 | 0/1 | 12.5s |
| #148 | Inkling low | Thinkingmachines | 3.0 | 6.1 | $0.187 | 0/1 | 3.12s |
| #79 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.177 | 1/1 | 2.75s | |
| #205 | MiniMax M2.7 medium | Minimax | 3.0 | 5.0 | $0.176 | 0/1 | 22.8s |
| #230 | GLM 4.7 Flash medium | Z.ai | 3.0 | 4.3 | $0.166 | 0/1 | 11.1s |