Navigare
AI BENCHY
Compară Grafice Metodologie
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs Qwen: Qwen3.5-27B

Compară:

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-06

Metrică OpenAI: GPT-5.3 Chat none Lansare: 2026-03-03 Qwen: Qwen3.5-27B medium Lansare: 2026-02-24
Rang #19 #7
Scor mediu 7.3 8.2
Consistență 8.5 9.1
Cost per rezultat 3.163 3.585
Cost total $0.317 $0.431
Teste corecte
Rată de trecere pe încercare 70.8% 81.3%
Teste instabile 3 2
Rulări totale 48 (16 x 3) 48 (16 x 3)
Tokenuri de ieșire 19,272 1,658
Tokenuri de raționament 0 200,786
Timp de răspuns (mediu) 5.96s 52.13s
Timp de răspuns (maxim) 18.33s 163.96s
Timp de răspuns (total) 95.30s 834.16s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor mediu vs Timp de răspuns (mediu)

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
OpenAI: GPT-5.3 Chat 7.3 7.5 77.8% 1 4.72s 3,091 0
Qwen: Qwen3.5-27B 10.0 10.0 100.0% 0 9.69s 102 8,956
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
OpenAI: GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
Qwen: Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 483 9,991
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
OpenAI: GPT-5.3 Chat 9.9 10.0 100.0% 0 2.21s 942 0
Qwen: Qwen3.5-27B 9.9 10.0 100.0% 0 30.26s 270 16,150
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
OpenAI: GPT-5.3 Chat 10.0 4.4 33.3% 2 13.01s 8,264 0
Qwen: Qwen3.5-27B 4.0 10.0 33.3% 0 79.53s 43 52,368
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
OpenAI: GPT-5.3 Chat 4.0 10.0 0.0% 0 1.99s 319 0
Qwen: Qwen3.5-27B 5.0 3.1 66.7% 1 101.41s 70 23,147
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
OpenAI: GPT-5.3 Chat 9.0 10.0 50.0% 0 3.29s 1,455 0
Qwen: Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 97 11,638
Puzzle Solving Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
OpenAI: GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
Qwen: Qwen3.5-27B 8.3 7.7 77.8% 1 64.61s 245 77,213
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
OpenAI: GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0
Qwen: Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 348 1,323

Comparație rapidă

Schimbă perechea de comparație