Fehler-Ranking für API-Fehler

Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst.

Angezeigte Modelle

Gesamtfehler

159

Am stärksten betroffenes Modell

Qwen3.6 Plus Preview 8

Kategorien

In der Kategorie Programmierung44 In der Kategorie Kombiniert25 In der Kategorie Werkzeugaufrufe17 In der Kategorie Anti-KI-Tricks14 In der Kategorie Datenanalyse und -extraktion14 In der Kategorie Allgemeinwissen13 In der Kategorie Allgemeine Intelligenz12 In der Kategorie Rätsellösen12 In der Kategorie Domänenspezifisch7 In der Kategorie Befolgung von Anweisungen1

66/66

Rang	Modell	Unternehmen	API-Fehler-Anzahl	Punktzahl	Gesamtkosten	Korrekte Tests	Antwortzeit (Durchschnitt)
#171	Qwen3.6 Plus Preview medium	Qwen	8	4.9	$0.000	9/19	15.2s
Gesamttests 19 Falsche Tests 10 Gesamtkosten $0.000 Antwortzeit (Durchschnitt) 15.2s
#131	Hy3 preview high	Tencent	7	5.9	$0.048	11/21	56.6s
Gesamttests 21 Falsche Tests 10 Gesamtkosten $0.048 Antwortzeit (Durchschnitt) 56.6s
#149	Hy3 preview low	Tencent	7	5.5	$0.015	10/21	24.6s
Gesamttests 21 Falsche Tests 11 Gesamtkosten $0.015 Antwortzeit (Durchschnitt) 24.6s
#175	Ring-2.6-1T none	Inclusionai	6	4.8	$0.026	9/22	55.1s
Gesamttests 22 Falsche Tests 13 Gesamtkosten $0.026 Antwortzeit (Durchschnitt) 55.1s
#203	Nemotron 3 Nano Omni 30b A3b Reasoning medium	NVIDIA	6	3.4	$0.000	4/19	17.1s
Gesamttests 19 Falsche Tests 15 Gesamtkosten $0.000 Antwortzeit (Durchschnitt) 17.1s
#204	Nemotron 3 Nano Omni 30b A3b Reasoning none	NVIDIA	6	3.2	$0.000	2/19	728ms
Gesamttests 19 Falsche Tests 17 Gesamtkosten $0.000 Antwortzeit (Durchschnitt) 728ms
#78	Gemini 3.5 Flash none	Google	4	7.0	$1.079	15/22	9.93s
Gesamttests 22 Falsche Tests 7 Gesamtkosten $1.079 Antwortzeit (Durchschnitt) 9.93s
#129	Gemini 3 PRO Preview medium	Google	4	6.0	$0.385	14/21	9.05s
Gesamttests 21 Falsche Tests 7 Gesamtkosten $0.385 Antwortzeit (Durchschnitt) 9.05s
#136	Nemotron 3 Super medium	NVIDIA	4	5.7	$0.066	8/22	52.0s
Gesamttests 22 Falsche Tests 14 Gesamtkosten $0.066 Antwortzeit (Durchschnitt) 52.0s
#169	DeepSeek V3.2 none	DeepSeek	4	5.0	$0.054	6/22	18.3s
Gesamttests 22 Falsche Tests 16 Gesamtkosten $0.054 Antwortzeit (Durchschnitt) 18.3s
#182	Laguna M.1 medium	Poolside	4	4.7	$0.033	9/19	14.7s
Gesamttests 19 Falsche Tests 10 Gesamtkosten $0.033 Antwortzeit (Durchschnitt) 14.7s
#188	Laguna M.1 none	Poolside	4	4.4	$0.009	4/19	2.89s
Gesamttests 19 Falsche Tests 15 Gesamtkosten $0.009 Antwortzeit (Durchschnitt) 2.89s
#194	Laguna Xs.2 medium	Poolside	4	4.1	$0.015	6/19	6.73s
Gesamttests 19 Falsche Tests 13 Gesamtkosten $0.015 Antwortzeit (Durchschnitt) 6.73s
#195	Hy3 preview none	Tencent	4	4.0	$0.003	4/21	12.9s
Gesamttests 21 Falsche Tests 17 Gesamtkosten $0.003 Antwortzeit (Durchschnitt) 12.9s
#201	Laguna Xs.2 none	Poolside	4	3.8	$0.004	5/19	806ms
Gesamttests 19 Falsche Tests 14 Gesamtkosten $0.004 Antwortzeit (Durchschnitt) 806ms

1 2 3 4 5

→

API-Fehler-Fehler

Modelle filtern

Top-Modelle nach API-Fehler-Anzahl

API-Fehler-Anzahl vs Punktzahl

Top-Modelle nach Antwortzeit (Durchschnitt)