Рейтинг Программирование
Посмотрите, какие AI-модели лучше всего справляются с Программирование, какие остаются надежными и где заметнее всего разница. Сортировать по: Общая стоимость ↓.
Показано моделей
15
Среднее значение Оценка Программирование
0.6
Лучшая модель
Claude Sonnet 5.5 1.0
408/408
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Программирование | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #356 | KAT Coder AIR V2.5 default | Kwaipilot | 0.3 | 0.4 | $0.070 | 0/3 | 14.3s |
| #261 | Gemini 3.1 Flash Lite none | 0.5 | 0.6 | $0.069 | 1/3 | 938ms | |
| #371 | Grok 4.1 Fast medium | X AI | 0.8 | 0.4 | $0.069 | 0/1 | 23.6s |
| #343 | GPT-5.4 Nano none | OpenAI | 0.5 | 0.5 | $0.068 | 0/3 | 2.22s |
| #186 | Solar Pro 4 xhigh | Upstage | 0.6 | 0.7 | $0.067 | 1/3 | 292.2s |
| #326 | Qwen3 Coder Next default | Qwen | 0.5 | 0.5 | $0.067 | 0/3 | 2.22s |
| #132 | GPT-5.6 Luna medium | OpenAI | 0.5 | 0.7 | $0.065 | 1/3 | 10.4s |
| #385 | Command A+ medium | Cohere | 0.3 | 0.3 | $0.064 | 0/3 | 93.1s |
| #120 | Claude Haiku 5.5 medium | Anthropic | 0.6 | 0.8 | $0.063 | 1/3 | 7.16s |
| #154 | Qwen3.7 Flash high | Qwen | 0.8 | 0.7 | $0.063 | 2/3 | 58.8s |
| #64 | Claude Haiku 5.5 low | Anthropic | 0.8 | 0.9 | $0.061 | 2/3 | 7.30s |
| #296 | MiMo-V2.6-Flash none | Xiaomi | 0.4 | 0.5 | $0.060 | 0/3 | 744ms |
| #384 | Grok 4.20 none | X AI | 0.1 | 0.3 | $0.057 | 0/1 | 1.22s |
| #142 | GLM 5.3 Flash high | Z.ai | 0.8 | 0.7 | $0.056 | 2/3 | 19.6s |
| #306 | Inkling Small low | Thinkingmachines | 0.5 | 0.5 | $0.055 | 0/3 | 3.70s |