AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Сбои по категориям AI BENCHY

Комбинированный: Ошибка API

Комбинированный
Ошибка API

Посмотрите, какие AI-модели чаще всего сталкиваются с Ошибка API в Комбинированный, чтобы быстрее находить слабые места. Сортировать по: Время ответа (среднее) ↑.

Показано моделей

13

Всего сбоев

13

Наиболее затронутая модель

Gemini 3.5 Flash 1
Ранг Модель Компания Количество Ошибка API Оценка категории Тестов верно Время ответа (среднее)
#20 Gemini 3.5 Flash none Google 1 3.0 0/1 0ms
#27 Gemma 4 31B medium Google 1 3.0 0/1 0ms
#46 Qwen3.6 35B A3B medium Qwen 1 3.0 0/1 0ms
#83 Step 3.5 Flash none Stepfun 1 3.0 0/1 0ms
#84 Grok 4.20 Multi Agent Beta medium X AI 1 3.0 0/1 0ms
#85 Gemma 4 31B none Google 1 3.0 0/1 0ms
#96 Ring-2.6-1T none Inclusionai 1 3.0 0/1 0ms
#100 Grok Build 0.1 none X AI 1 3.0 0/1 0ms
#126 gpt-oss-120b none OpenAI 1 3.0 0/1 0ms
#149 Nemotron 3 Nano Omni 30b A3b Reasoning medium NVIDIA 1 3.0 0/1 0ms
#153 Qwen3.6 35B A3B none Qwen 1 3.0 0/1 0ms
#160 LFM2-24B-A2B none Liquid 1 3.0 0/1 0ms
#162 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 1 3.0 0/1 0ms

Лучшие модели по Количество Ошибка API

Количество Ошибка API против Оценка

Лучшие модели по Время ответа (среднее)

Лучшие модели по Оценочная стоимость потерь