Datenanalyse und -extraktion: Falsche Antwort
Datenanalyse und -extraktion
Falsche Antwort
Sieh, welche KI-Modelle bei Datenanalyse und -extraktion am ehesten auf Falsche Antwort stoßen, damit du Schwachstellen schneller erkennst.
Fehlergründe
59/59
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Falsche Antwort-Anzahl | Kategorie-Score | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #135 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 1 | 7.3 | $0.478 | 1/2 | 4.70s |
| #147 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 7.3 | $0.221 | 1/2 | 18.8s |
| #155 | LongCat 2.0 high | Meituan | 1 | 3.6 | $0.492 | 0/2 | 11.0s |
| #170 | Dots 3 Note Preview low | Dots Studio | 1 | 7.3 | $0.000 | 1/2 | 11.5s |
| #171 | Dots 3 Note Preview high | Dots Studio | 1 | 7.3 | $0.000 | 1/2 | 12.7s |
| #173 | MiMo-V2.5 medium | Xiaomi | 1 | 2.7 | $0.104 | 0/2 | 6.33s |
| #174 | Ling-3.0-flash high | Inclusionai | 1 | 7.3 | $0.021 | 1/2 | 7.15s |
| #175 | Ring-2.6-1T medium | Inclusionai | 1 | 6.5 | $0.102 | 1/2 | 37.4s |
| #176 | Mimo V2 PRO medium | Xiaomi | 1 | 7.3 | $0.333 | 1/2 | 17.2s |
| #184 | gpt-oss-120b medium | OpenAI | 1 | 6.4 | $0.020 | 1/2 | 1.98s |
| #189 | Trinity Large Thinking medium | Arcee AI | 1 | 6.3 | $0.756 | 1/2 | 16.4s |
| #194 | Trinity Large Thinking low | Arcee AI | 1 | 7.3 | $0.625 | 1/2 | 14.3s |
| #203 | Dots 3 Note Preview medium | Dots Studio | 1 | 4.5 | $0.000 | 0/2 | 78.5s |
| #208 | Seed 2.1 Turbo none | Bytedance Seed | 1 | 7.1 | $0.092 | 1/2 | 2.63s |
| #220 | KAT-Coder-Air V2.5 high | Kwaipilot | 1 | 6.5 | $0.077 | 1/2 | 3.59s |