Рейтинг Программирование
Посмотрите, какие AI-модели лучше всего справляются с Программирование, какие остаются надежными и где заметнее всего разница. Сортировать по: Тестов верно ↓.
Показано моделей
15
Среднее значение Оценка Программирование
6.1
Лучшая модель
Gemini 3.6 Flash 10.0
289/289
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Программирование | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #92 | Kimi K2.7 Code medium | Moonshot AI | 7.8 | 7.4 | $0.709 | 2/3 | 146.7s |
| #100 | KAT-Coder-Pro V2.5 low | Kwaipilot | 7.8 | 7.3 | $0.400 | 2/3 | 24.9s |
| #107 | Muse Glimmer 30B high | Meta | 8.8 | 7.2 | $0.535 | 2/3 | 96.0s |
| #110 | Muse Glimmer 30B medium | Meta | 8.4 | 7.2 | $0.280 | 2/3 | 33.7s |
| #112 | Muse Glimmer 30B low | Meta | 8.1 | 7.1 | $0.187 | 2/3 | 16.5s |
| #113 | Step 3.7 Flash low | Stepfun | 8.2 | 7.1 | $0.390 | 2/3 | 9.46s |
| #120 | Mercury 2 medium | Inception | 8.2 | 7.0 | $0.094 | 2/3 | 2.04s |
| #124 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 7.8 | 6.9 | $0.478 | 2/3 | 33.1s |
| #127 | Gemini 3.5 Flash none | 8.8 | 6.9 | $1.093 | 2/3 | 34.7s | |
| #130 | Seed-2.0-Code medium | Bytedance Seed | 8.9 | 6.8 | $1.153 | 2/3 | 89.9s |
| #143 | LongCat 2.0 high | Meituan | 7.8 | 6.7 | $0.492 | 2/3 | 505.3s |
| #148 | Inkling Small medium | Thinkingmachines | 7.8 | 6.6 | $0.113 | 2/3 | 10.5s |
| #150 | Qwen3.6 35B A3B medium | Qwen | 7.7 | 6.6 | $0.749 | 2/3 | 50.5s |
| #152 | Qwen3.6 27B medium | Qwen | 7.7 | 6.5 | $1.045 | 2/3 | 143.0s |
| #176 | Trinity Large Thinking medium | Arcee AI | 7.5 | 6.1 | $0.798 | 2/3 | 179.0s |