Fehler-Ranking für Zeitüberschreitung

Sieh, bei welchen KI-Modellen Zeitüberschreitung besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Korrekte Tests ↑.

Angezeigte Modelle

Gesamtfehler

Am stärksten betroffenes Modell

Qwen3.5-9B 12

Kategorien

In der Kategorie Domänenspezifisch43 In der Kategorie Programmierung26 In der Kategorie Kombiniert5 In der Kategorie Rätsellösen5 In der Kategorie Allgemeine Intelligenz4 In der Kategorie Anti-KI-Tricks4 In der Kategorie Befolgung von Anweisungen1 In der Kategorie Datenanalyse und -extraktion1

44/44

Rang	Modell	Unternehmen	Zeitüberschreitung-Anzahl	Punktzahl	Gesamtkosten	Korrekte Tests	Antwortzeit (Durchschnitt)
#210	Qwen3.5-9B medium	Qwen	12	3.8	$0.036	3/22	82.2s
Gesamttests 22 Falsche Tests 19 Gesamtkosten $0.036 Antwortzeit (Durchschnitt) 82.2s
#193	Qwen3 Coder Next medium	Qwen	1	4.7	$0.032	4/22	9.61s
Gesamttests 22 Falsche Tests 18 Gesamtkosten $0.032 Antwortzeit (Durchschnitt) 9.61s
#200	GLM 4.7 Flash medium	Z.ai	2	4.3	$0.166	4/22	142.6s
Gesamttests 22 Falsche Tests 18 Gesamtkosten $0.166 Antwortzeit (Durchschnitt) 142.6s
#166	Laguna XS 2.1 none	Poolside	1	5.3	$0.008	5/22	1.55s
Gesamttests 22 Falsche Tests 17 Gesamtkosten $0.008 Antwortzeit (Durchschnitt) 1.55s
#178	MiniMax M2.7 medium	Minimax	2	5.0	$0.163	5/22	41.3s
Gesamttests 22 Falsche Tests 17 Gesamtkosten $0.163 Antwortzeit (Durchschnitt) 41.3s
#196	MiniMax M2.5 medium	Minimax	4	4.6	$0.340	5/22	68.3s
Gesamttests 22 Falsche Tests 17 Gesamtkosten $0.340 Antwortzeit (Durchschnitt) 68.3s
#146	Nemotron 3 Super medium	NVIDIA	1	5.7	$0.055	8/22	52.0s
Gesamttests 22 Falsche Tests 14 Gesamtkosten $0.055 Antwortzeit (Durchschnitt) 52.0s
#162	Gemma 4 26B A4B none	Google	1	5.5	$0.015	8/22	7.64s
Gesamttests 22 Falsche Tests 14 Gesamtkosten $0.015 Antwortzeit (Durchschnitt) 7.64s
#102	LongCat 2.0 high	Meituan	3	6.6	$0.469	9/22	148.7s
Gesamttests 22 Falsche Tests 13 Gesamtkosten $0.469 Antwortzeit (Durchschnitt) 148.7s
#134	GPT-5 Nano medium	OpenAI	1	6.1	$0.114	9/22	54.9s
Gesamttests 22 Falsche Tests 13 Gesamtkosten $0.114 Antwortzeit (Durchschnitt) 54.9s
#190	Hunter Alpha medium	OpenRouter	2	4.7	$0.000	8/18	10.3s
Gesamttests 18 Falsche Tests 10 Gesamtkosten $0.000 Antwortzeit (Durchschnitt) 10.3s
#50	DeepSeek V4 Pro high	DeepSeek	1	7.7	$0.200	10/22	79.1s
Gesamttests 22 Falsche Tests 12 Gesamtkosten $0.200 Antwortzeit (Durchschnitt) 79.1s
#81	Kimi K2.5 medium	Moonshot AI	2	7.0	$0.600	10/22	99.0s
Gesamttests 22 Falsche Tests 12 Gesamtkosten $0.600 Antwortzeit (Durchschnitt) 99.0s
#96	LongCat 2.0 low	Meituan	1	6.7	$0.391	10/22	100.3s
Gesamttests 22 Falsche Tests 12 Gesamtkosten $0.391 Antwortzeit (Durchschnitt) 100.3s
#191	Grok 4.1 Fast medium	X AI	1	4.7	$0.069	9/19	23.8s
Gesamttests 19 Falsche Tests 10 Gesamtkosten $0.069 Antwortzeit (Durchschnitt) 23.8s

Zeitüberschreitung-Fehler

Modelle filtern

Top-Modelle nach Zeitüberschreitung-Anzahl

Zeitüberschreitung-Anzahl vs Punktzahl

Top-Modelle nach Antwortzeit (Durchschnitt)