Vergleichen Diagramme Methodik

Sprache:

❤️ Made by XCS

AI BENCHY Compare

Trinity Large Preview vs Qwen: Qwen3.5-35B-A3B

Vergleichen:

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-03-06

Metrik	Trinity Large Preview none Veröffentlichung: 2026-01-27 Kostenlos verfügbar	Qwen: Qwen3.5-35B-A3B medium Veröffentlichung: 2026-02-24
Rang	#45	#35
Ø-Score	4.2	5.5
Konsistenz	9.6	6.3
Kosten pro Ergebnis	0.000	4.251
Gesamtkosten	$0.000	$0.341
Korrekte Tests
Erfolgsquote pro Versuch	33.3%	77.1%
Instabile Tests	1	7
Gesamtläufe	48	48
Ausgabe-Token	1,837	5,495
Denk-Token	0	169,266
Antwortzeit (Durchschnitt)	3.15s	43.93s
Antwortzeit (Maximum)	8.91s	106.00s
Antwortzeit (Gesamt)	50.46s	702.85s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Ø-Score vs Antwortzeit (Durchschnitt)

Kategorieaufschlüsselung

Anti-KI-Tricks	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Trinity Large Preview	10.0	10.0	0.0%	0		3.59s	587	0
Qwen: Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		21.75s	429	36,235

Kombiniert	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Trinity Large Preview	10.0	10.0	0.0%	0		8.91s	294	0
Qwen: Qwen3.5-35B-A3B	10.0	1.6	66.7%	1		75.34s	775	12,485

Datenanalyse und -extraktion	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Trinity Large Preview	9.9	10.0	100.0%	0		3.26s	186	0
Qwen: Qwen3.5-35B-A3B	5.5	5.9	83.3%	1		59.33s	235	19,493

Domänenspezifisch	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Trinity Large Preview	4.0	10.0	33.3%	0		877ms	25	0
Qwen: Qwen3.5-35B-A3B	10.0	4.4	44.5%	2		88.34s	41	46,368

Allgemeine Intelligenz	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Trinity Large Preview	3.0	9.9	0.0%	0		2.86s	124	0
Qwen: Qwen3.5-35B-A3B	10.0	1.6	33.3%	1		30.30s	20	3,753

Befolgung von Anweisungen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Trinity Large Preview	3.5	6.7	16.7%	1		1.09s	63	0
Qwen: Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		24.45s	97	17,361

Puzzle Solving	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Trinity Large Preview	4.0	10.0	33.3%	0		3.30s	291	0
Qwen: Qwen3.5-35B-A3B	4.0	4.4	77.8%	2		31.58s	3,589	32,206

Werkzeugaufrufe	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Ausgabe-Token	Denk-Token
Trinity Large Preview	10.0	10.0	100.0%	0		6.67s	267	0
Qwen: Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		4.65s	309	1,365

Schnellvergleich

Vergleichspaar wechseln

DeepSeek V3.2nonevsQwen3.5-35B-A3Bmedium Gemini 2.5 FlashnonevsQwen3.5-35B-A3Bmedium Trinity Large PreviewnoneKostenlos verfügbarvsMiniMax M2.5medium Qwen3.5-35B-A3BmediumvsGLM 5none Trinity Large PreviewnoneKostenlos verfügbarvsQwen3 Coder Nextmedium Trinity Large PreviewnoneKostenlos verfügbarvsgpt-oss-120bmediumKostenlos verfügbar GPT-5.4nonevsQwen3.5-35B-A3Bmedium Trinity Large PreviewnoneKostenlos verfügbarvsMercury 2medium Trinity Large PreviewnoneKostenlos verfügbarvsGLM 4.7 Flashmedium Claude Sonnet 4.6nonevsQwen3.5-35B-A3Bmedium Trinity Large PreviewnoneKostenlos verfügbarvsGPT-5 Nanomedium Kimi K2.5nonevsQwen3.5-35B-A3Bmedium