Парсинг и извлечение данных: Неверный ответ
Парсинг и извлечение данных
Неверный ответ
Посмотрите, какие AI-модели чаще всего сталкиваются с Неверный ответ в Парсинг и извлечение данных, чтобы быстрее находить слабые места.
Причины сбоев
36/36
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Количество Неверный ответ | Оценка категории | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #128 | GPT-5 Nano medium | OpenAI | 2 | 3.7 | $0.114 | 0/2 | 21.4s |
| #190 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.340 | 0/2 | 7.48s |
| #201 | Granite 4.1 8B none | IBM Granite | 2 | 3.0 | $0.007 | 0/2 | 575ms |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 2 | 3.8 | $0.000 | 0/2 | 1.42s |
| #210 | LFM2-24B-A2B none | Liquid | 2 | 3.0 | $0.001 | 0/2 | 714ms |
| #14 | Claude Opus 4.8 medium | Anthropic | 1 | 7.1 | $1.931 | 1/2 | 12.3s |
| #41 | Claude Opus 4.8 low | Anthropic | 1 | 6.3 | $2.077 | 1/2 | 2.27s |
| #66 | Claude Opus 4.8 none | Anthropic | 1 | 7.3 | $1.166 | 1/2 | 1.77s |
| #67 | Step 3.7 Flash low | Stepfun | 1 | 7.3 | $0.454 | 1/2 | 2.29s |
| #78 | Mercury 2 medium | Inception | 1 | 7.3 | $0.093 | 1/2 | 1.11s |
| #81 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 1 | 7.3 | $0.467 | 1/2 | 4.70s |
| #84 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 7.3 | $0.187 | 1/2 | 18.8s |
| #97 | LongCat 2.0 high | Meituan | 1 | 3.6 | $0.469 | 0/2 | 11.0s |
| #101 | MiMo-V2.5 medium | Xiaomi | 1 | 2.7 | $0.082 | 0/2 | 6.33s |
| #108 | Ring-2.6-1T medium | Inclusionai | 1 | 6.5 | $0.103 | 1/2 | 37.4s |